基于机器学习的婴儿哭泣解释
Mohammed Hammoud1, Melaku N Getahun1, Anna Baldycheva2
1Digital Engineering CREI, Skolkovo Institute of Science and Technology, Moscow, Russia.
Frontiers in artificial intelligence
|February 23, 2024
概括
对护理人员来说,解释婴儿的哭泣是个挑战. 这项研究开发了一种先进的机器学习模型,使用Mel-frequency cepstral系数 (MFCC) 和随机森林分类器来准确解码婴儿救援信号.
科学领域:
- 婴儿通信和信号处理.
- 机器学习在医疗保健中的应用.
背景情况:
- 婴儿的哭泣是主要的沟通方式,护理人员往往难以解释.
- 误解婴儿的哭声可能会导致婴儿福祉的重大问题.
- 现有的哭声分析方法需要改进音频特征表示和分类.
研究的目的:
- 开发一个准确的婴儿哭泣分析系统.
- 为了评估各种音频特征表示和机器学习分类器的声音解释.
- 根据发声识别婴儿状态的最佳特征和模型,以区分婴儿状态.
主要方法:
- 使用的时间域 (零交叉率,根平均平方),频域 (梅尔谱图) 和时间频域 (梅尔频率塞普斯特拉系数 - MFCC) 音频功能.
- 应用时间序列成像算法,将MFCC特征转化为视觉表示.
- 训练并评估了多个机器学习分类器,包括决策树,随机森林,K-最近邻居和包装.
主要成果:
- 麦尔频率塞普斯特拉系数 (MFCC),零交叉率 (ZCR) 和根平均平方 (RMS) 特性表现出高性能.
- 基于MFCC的随机森林 (RF) 分类器实现了96.39%的准确率.
- 这一性能超过了基于刻度图的最先进的ShuffleNet分类器 (95.17%准确率).
结论:
- 拟议的基于MFCC的随机森林方法为婴儿哭声分析提供了一种高度有效的方法.
- 这项研究强调了先进的音频特征提取和机器学习对于理解婴儿沟通的重要性.
- 这些发现提供了一个有希望的工具,以帮助护理人员更准确地解释婴儿的需求.
更多相关视频
09:24Quantified Assessment of Infant's Gross Motor Abilities Using a Multisensor Wearable
Published on: May 17, 2024
1.4K
04:54Author Spotlight: IntelliSleepScorer — A High-Accuracy, Accessible GUI Software for Automated Sleep Stage Scoring in Mice and its Application in Psychiatric Research
Published on: November 8, 2024
514
