尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

面向语音情感识别、音视频情绪分析与情感计算研究的高质量数据集

面向语音情感识别、音视频情绪分析与情感计算研究的高质量数据集 摘要面向语音情感识别、音视频情绪分析与情感计算研究的高质量数据集。数据集概述面向语音情感识别、音视频情绪分析与情感计算研究的高质量数据集。数据由 4 名英语母语男性说话者录制年龄约为 27–31 岁说话者编号分别为 DC、JE、JK 和 KL。数据集覆盖 愤怒、厌恶、恐惧、快乐、悲伤、惊讶和中性 7 类情绪每名说话者包含 120 条语音表达因此共约 480 条情感语音样本。由于说话者全部为男性该数据集适合与女性说话者占比较高的数据集联合使用以提升情绪识别模型的性别泛化能力。数据结构与关键特征TESS 数据集按照“说话者 情绪类别”进行文件夹组织每位女性说话者的不同情绪分别保存在独立目录中每个情绪目录包含 200 个目标词对应的音频文件。所有语音均使用固定载体句式 “Say the word ___” 进行录制从而在控制语言内容的同时突出不同情绪状态下的声学变化。其核心可分析特征包括基频、能量、语速、音高变化、MFCC、频谱质心、过零率、共振峰及语音节奏等可用于研究不同情绪在声学层面的差异。应用价值与研究方向该数据集适用于七类语音情感分类、说话人无关情感识别、声学特征分析和情感语音建模等任务。研究人员可以采用 MFCC SVM、随机森林等传统方法也可以使用 CNN、CRNN、LSTM、Audio Transformer、Wav2Vec 2.0 或 HuBERT 等深度学习模型进行情绪识别。进一步可研究年龄差异对情绪表达的影响、跨说话人泛化、类别混淆分析、多数据集联合训练以及面向语音助手、智能客服和人机交互系统的实时情绪识别。数据集来源由张家梁(Bob)整理并于2026年在7zcode平台公开发布。数据集信息免责声明与引用数据仅用于科研与教学用途。若用于商业场景请自行核验数据许可。如需引用请在论文或报告中注明数据集名称与版本号。作者信息作者Bob (张家梁)项目编号Datasets-473文件大小100M原创声明本数据集为整理作品
返回列表