TLFS23泰米尔语手指拼写数据集
Bavesh Ram S1, Chirranjeavi M1, Aaruran S1
1Department of Electronics and Communication Engineering, Amrita School of Engineering, Amrita Vishwa Vidyapeetham, Coimbatore, India.
Data in brief
|January 17, 2024
概括
一个新的泰米尔手指拼写数据集 (TLFS23) 已被创建,以开发基于视觉的翻译器,用于语音和听力障碍者. 此资源有助于构建用于增强通信的自动化系统.
科学领域:
- 计算语言学 计算语言学
- 计算机视觉 计算机视觉
- 深度学习 (Deep Learning) 是一种深度学习.
背景情况:
- 泰米尔语是一个古老的语言,有6500万的说者,提出了独特的沟通挑战.
- 语音和听力障碍社区需要专门的工具来进行有效的沟通.
- 现有的基于视觉的翻译器缺乏针对泰米尔语等复杂语言的全面数据集.
研究的目的:
- 为计算机视觉和深度学习的研究引入泰米尔手指拼写数据集 (TLFS23).
- 为了促进泰米尔手指拼写的自动翻译系统的发展.
- 为了改善泰米尔语人士的言语和听力障碍的沟通可访问性.
主要方法:
- 收集了一个大规模的,标记的数据集的泰米尔手指拼写手势.
- 数据集包括248个类中的255,155个图像,代表着247个泰米尔字符.
- 来自不同年龄组的120个个体的图像被捕获,确保了多样化的表示.
主要成果:
- TLFS23数据集为每一个泰米尔字符提供1000张图像,每个独特的手指 flexion.
- 这一全面的数据集使得深度学习模型能够进行强大的训练,以识别手指拼写.
- 该数据集是公开可用的,促进进一步的研究和开发.
结论:
- TLFS23数据集是对辅助技术和计算语言学领域的重要贡献.
- 它为推进泰米尔手指拼写的基于视觉的高级翻译铺平了道路.
- 这个资源有可能弥合发言和听力障碍的泰米尔语人口的沟通差距.


