婴儿哭声音频语料库
摘要婴儿哭声音频语料库Infant Cry Audio Corpus是通过 Donate-a-cry 公益采集活动构建的婴儿哭声数据集音频样本由用户通过 Android 和 iOS 移动应用自主上传。数据集概述婴儿哭声音频语料库Infant Cry Audio Corpus是通过 Donate-a-cry 公益采集活动构建的婴儿哭声数据集音频样本由用户通过 Android 和 iOS 移动应用自主上传。数据集中保存的是原始、未经修改和人工审核的婴儿哭声音频并由贡献者自行标注婴儿性别、年龄阶段以及可能的哭泣原因可用于婴儿哭声识别、音频分类和智能育儿辅助等研究。数据结构与关键特征数据集的标签信息直接编码在音频文件名中主要包括应用实例 UUID、录制时间戳、应用版本、婴儿性别、年龄阶段和哭泣原因等信息。其中性别包括男性m和女性f年龄划分为 0–4 周、4–8 周、2–6 个月、7 个月–2 岁以及 2 岁以上等阶段哭泣原因包括饥饿hu、需要拍嗝bu、腹痛bp、不适dc、疲劳ti、孤独lo、冷热不适ch、害怕sc和未知dk等类别。iOS 与 Android 文件采用相似命名结构主要区别在于 Android 时间戳以毫秒表示而 iOS 使用秒级 Unix 时间戳。应用价值与研究方向该数据集可用于婴儿哭声原因分类、年龄与性别相关声学特征分析、异常哭声识别、智能婴儿监护和辅助育儿系统等研究。研究人员可以提取 MFCC、Mel 频谱、基频、能量和声谱图等音频特征并结合 CNN、LSTM、CRNN、Transformer 或预训练音频模型进行分类与识别还可进一步探索噪声环境下的鲁棒识别、类别不平衡处理、自监督音频表示学习和移动端轻量化部署为智能婴儿监护设备和婴幼儿健康辅助分析提供数据基础。数据集来源由张家梁(Bob)整理并于2026年在7zcode平台公开发布。数据集信息免责声明与引用数据仅用于科研与教学用途。若用于商业场景请自行核验数据许可。如需引用请在论文或报告中注明数据集名称与版本号。作者信息作者Bob (张家梁)项目编号Datasets-536文件大小39M原创声明本数据集为整理作品