尼泊尔手语字母的NSL23数据集
Jhuma Sunuwar1, Samarjeet Borah1, Aditi Kharga1
1Sikkim Manipal Institute of Technology, Sikkim Manipal University, Sikkim, 737136, India.
Data in brief
|February 8, 2024
概括
本研究介绍了第一个尼泊尔手语数据集 (NSL23),这是开发手语翻译技术的关键资源. 该数据集有助于训练尼泊尔手语字母表识别的机器学习模型.
科学领域:
- 语言学的语言学.
- 计算机科学 计算机科学
- 人工智能的人工智能
背景情况:
- 尼泊尔手语 (NSL) 是尼泊尔语社区的一个重要通信系统.
- 现有的手语翻译研究缺乏NSL的资源.
- 计算机视觉技术的进步为手语翻译提供了潜力.
研究的目的:
- 引入第一个公开可用的尼泊尔手语数据集 (NSL23).
- 为NSL中机器学习模型开发提供基础数据集.
- 为了促进自动化NSL到文本/音频翻译的研究.
主要方法:
- 创建NSL23数据集,其中包括NSL手势的mov视频.
- 包括36个辅音符号和13个元音符号,由14名志愿者执行.
- 在不同条件下 (照明,环境) 收集数据,用户的专业知识不同 (初学者/专家).
主要成果:
- NSL23数据集包含630个视频,代表了1205个手势.
- 该数据集捕获了NSL字母表的符号,由初学者和专家进行.
- 它包括数据变化,以提高模型的稳定性.
结论:
- NSL23数据集对NSL研究做出了重大贡献.
- 它可以训练机器学习模型进行NSL字母表分类.
- 预计这一数据集将加速NSL翻译工具的开发.


