相关数据集
D037_Chinese_Multi_emotional_Modal_particle_and_Natural_Conversa
中文多情感语气词及自由对话合成库,由多位中文母语声优录制。既包括含有丰富语气词的句子,贴合日常表达习惯;又包含给定话题下的自由对话数据,且每段对话中,各说话人的音频独立存储于各自音轨。专业语音学家已对文字内容等信息进行标注,充分满足语音合成研发的精准需求。
Opencsg2026-03-04 更新150
ADEPT
ADEPT数据集由Papercup Technologies Ltd.和爱丁堡大学创建,旨在评估语音合成中的韵律转移。该数据集包含552条自然语音样本,涵盖了情感、人际态度等全球韵律变化和话题强调、命题态度等局部韵律变化。数据集的创建过程涉及确定韵律类别、设计句子并录制,确保听众能准确区分不同韵律。ADEPT数据集主要应用于评估和改进文本到语音系统的韵律转移技术,解决韵律表达的自然性和多样性问题。
arXiv2021-07-21 更新120
voices365/Chinese_Male_036VoiceArtist_9Hours_High_Quality_Voice_Dataset
--- license: cc-by-nc-2.0 task_categories: - text-to-speech - text-to-audio - text-to-video language: - zh size_categories: - 10B<n<100B --- ### Dataset Description This dataset was recorded by a prof
Hugging Face2024-11-11 更新100
Cossale/synthetic-gujarati-tts-dataset
该数据集包含音频和文本两种类型的数据,适用于训练相关的机器学习模型。训练集包含5000个示例,数据集总大小约为11.9GB。
Hugging Face2025-01-30 更新140
Parth376/kiksy-tts-tags
该数据集包含多个与语音相关的特征,如文本、说话者ID、音高均值、音高标准差、信噪比、C50、语速、音素、噪声、混响、语音单调性和文本描述等。数据集分为一个训练集,包含25个样本,总大小为9021字节。下载大小为13030字节。
Hugging Face2024-12-06 更新100



