通过众包听众评分来测量说话者的年龄估计:语音研究的试点研究
Raquel M A Tripp1, Eric J Hunter2, Aaron M Johnson3
1Department of Communicative Sciences and Disorders, New York University, NY.
Journal of speech, language, and hearing research : JSLHR
|January 17, 2025
概括
在线众包有效地复制了基于实验室的语音年龄估计. 这种方法提供了一种低成本,大量的方法来收集来自不同参与者的感知语音数据.
科学领域:
- 语音和听力科学 语言和听力科学
- 心理学 心理学 心理学
- 人与计算机的交互
背景情况:
- 听觉感知语音研究传统上依赖于训练有素的听众.
- 在线众包正在出现行为数据收集,但在语音感知研究中未得到充分利用.
- 这项研究探讨了众包对于语音特定年龄估计的可行性.
研究的目的:
- 评估在线众包对听觉感知语音评级的可行性.
- 使用在线平台复制基于实验室的语音年龄估计研究.
- 为了评估未经训练的听众在估计语音年龄方面的准确性.
主要方法:
- 50个未经训练的,众筹的听众估计了一个单独的演讲者的年龄.
- 他们使用了48年间20次演讲的音频样本.
- 年龄估计的准确性是主要的结果指标.
主要成果:
- 众筹的年龄估计与之前的实验室发现密切一致.
- 听众倾向于高估年轻的年龄,低估年长的年龄.
- 估计的年龄与演讲者的年代年龄相匹配,即54岁.
结论:
- 在线众包是一种可行的听觉感知语音评级方法.
- 这种方法为传统方法提供了低成本,高参与率的替代方案.
- 需要进一步的研究来验证复杂的语音参数的众包评分.


