相关数据集
46,498张车辆定损图像采集数据
46,498张车辆定损图像采集数据多样性包括多种车型、多种室外场景、多种车损类型、多种采集角度、不同拍摄距离、不同分辨率。车损类型涵盖磕碰、划伤、掉漆等多种车损。车损位置包括车辆的前引擎盖、左右大灯、车门、车身、车箱等。46,498张车辆定损图像采集数据可用于车辆自动定损等任务。
数据堂470
mahwizzzz/ur_nano_codec
乌尔都语Nano Codec语音合成数据集包含乌尔都语句子及其使用Nano Codec模型生成的tokenized表示。该数据集可用于训练文本到语音(TTS)模型、从tokens重建音频以及低资源乌尔都语语音研究。
Hugging Face2025-11-04 更新210
TTS-SCShhiDiaSC: A Scripted Chinese Shanghai Dialect Speech Corpus
This dataset consists of 10.17 hours of annotated male voices in Shanghai dialect that is applicable for Text-to-Speech Synthesis, where 8,499 utterances collected from a 21-year-old man were containe
MagicHub开源社区2021-10-14 更新140
Project AI❤dol Public English Dataset
由于公开的英语SVS数据严重缺乏,由女性歌手演唱的数据集尤为稀缺,因此决定发布自己的语料库。该数据集是完整数据集的一个精选,仅包含英语歌曲,并选择了最佳的演唱数据。标签仅使用默认的Arpabet音素。声音提供者不是英语母语者,但发音应该足够好。她也不是专业歌手,但演唱质量仍然可以接受。数据总时长为1小时45分钟。
github2024-09-15 更新330
672小时多人会议多通道采集语音数据
672小时多人会议多通道采集语音数据,内容覆盖3-6人规模的会议场景,在多种会议室环境中采集,反映了真实会议中的互动情境。此数据集标注了文本内容、说话人身份、性别及位置等多种属性,准确性高(句准确率≥97%),易用性强,为语音识别及声纹识别相关研究与应用提供了高质量资源,经多家AI公司验证:有助于提升模型在复杂会议场景下的鲁棒性。我们严格遵循数据保护法规和隐私规定,确保数据采集、存储和使用的过程中
数据堂210



