遇见数据集

Syntts-Commands-Media-Dataset

收藏
魔搭社区2026-07-09 更新2025-11-22 收录
官方服务:

资源简介:

Syntts-Commands-Media-Dataset 是一个专门针对**多媒体播放控制**场景的大规模多语言合成语音命令数据集。本数据集通过先进的文本到语音(TTS)技术生成,旨在为低功耗设备上的语音交互系统提供高质量、多样化的训练数据,特别适用于TinyML和边缘计算环境中的媒体控制应用。

Syntts-Commands-Media-Dataset is a large-scale multilingual synthetic speech command dataset specifically designed for the multimedia playback control scenario. This dataset is generated using advanced text-to-speech (TTS) technologies, aiming to provide high-quality and diverse training data for speech interaction systems on low-power devices, and is particularly suitable for media control applications in TinyML and edge computing environments.

提供机构:
maas
创建时间:
2025-11-11
搜集汇总
数据集介绍
Syntts-Commands-Media-Dataset 数据集图片
背景与挑战
背景概述
SynTTS-Commands-Media-Dataset是一个大规模、多语言的合成语音命令数据集,专为关键词唤醒和语音命令识别任务设计。它包含38万多条中英文语音样本,总时长超111小时,涵盖8100个说话人和48个多媒体控制指令,旨在解决边缘计算领域高质量训练数据稀缺的问题。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务