Syntts-Commands-Media-Dataset
收藏官方服务:
资源简介:
Syntts-Commands-Media-Dataset 是一个专门针对**多媒体播放控制**场景的大规模多语言合成语音命令数据集。本数据集通过先进的文本到语音(TTS)技术生成,旨在为低功耗设备上的语音交互系统提供高质量、多样化的训练数据,特别适用于TinyML和边缘计算环境中的媒体控制应用。
Syntts-Commands-Media-Dataset is a large-scale multilingual synthetic speech command dataset specifically designed for the multimedia playback control scenario. This dataset is generated using advanced text-to-speech (TTS) technologies, aiming to provide high-quality and diverse training data for speech interaction systems on low-power devices, and is particularly suitable for media control applications in TinyML and edge computing environments.
提供机构:
maas创建时间:
2025-11-11
搜集汇总
数据集介绍

背景与挑战
背景概述
SynTTS-Commands-Media-Dataset是一个大规模、多语言的合成语音命令数据集,专为关键词唤醒和语音命令识别任务设计。它包含38万多条中英文语音样本,总时长超111小时,涵盖8100个说话人和48个多媒体控制指令,旨在解决边缘计算领域高质量训练数据稀缺的问题。
以上内容由遇见数据集搜集并总结生成



