
摘要婴儿哭声感知数据集是一个专为支持使用机器学习和深度学习技术进行婴儿哭声自动识别研究而设计的宝贵资源。数据集简介数据集概述婴儿哭声感知数据集是一个专为支持使用机器学习和深度学习技术进行婴儿哭声自动识别研究而设计的宝贵资源。该数据集使研究人员和开发人员能够构建能够分析和解释与婴儿情绪和生理需求相对应的声学信号的智能系统。数据集包含 512 个音频样本分为 8 个不同类别代表婴儿可能哭泣的各种原因。该数据集来自多个公开资源的整合专为智能婴儿监护系统、家长辅助应用和人机交互HCI研究而设计。数据结构与关键特征数据集包含 512 个音频样本分为 8 个类别(1) belly_pain腹痛16 个文件(2) burping打嗝18 个文件(3) cold/hot冷/热7 个文件(4) discomfort不适30 个文件(5) hungry饥饿382 个文件74.6%最大类别(6) lonely孤独11 个文件(7) scared恐惧20 个文件(8) tired疲倦28 个文件。类别分布特征数据集呈现严重的类别不平衡饥饿类别占据主导地位74.6%而冷/热类别最少仅 7 个文件。应用价值与研究方向科学意义实现与不同需求和情绪状态对应的独特哭声模式建模支持智能婴儿监护系统和家长辅助应用的开发推进婴儿护理背景下的人机交互HCI研究。研究与开发机会提取高级音频特征如梅尔频率倒谱系数 MFCC 和频谱图使用 CNN、LSTM 和基于 Transformer 的架构构建分类模型分析哭声类型之间的细微差异以提高分类准确性并向护理人员提供情境感知建议。支持婴儿哭声自动识别、情绪识别、智能育儿系统、深度学习模型训练、音频信号处理、特征工程、婴儿监护设备、家长辅助应用、人机交互研究。重要提示由于严重的类别不平衡饥饿占 74.6%需要特别注意数据增强、重采样、加权损失等技术来改善模型在少数类别上的表现。数据集来源由张家梁(Bob)整理并于2026年在7zcode平台公开发布。数据集信息免责声明与引用数据仅用于科研与教学用途。若用于商业场景请自行核验数据许可。如需引用请在论文或报告中注明数据集名称与版本号。作者信息作者Bob (张家梁)项目编号Datasets-174文件大小56M原创声明本数据集为整理作品