登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Vocal mixing Chain by Gemini
Vocal mixing Chain by Gemini
收藏
kaggle
2024-11-13 更新
2024-12-14 收录
语音混音
音频处理
数据链接:
https://www.kaggle.com/datasets/gamalgomina/gemini-long-context-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Setting up a plugin chain for voice mixing by Gemini
搭建 Gemini 语音混音插件链
应用场景:
创建时间:
2024-11-01
相关数据集
distil-whisper/tedlium-timestamped
自动语音识别
音频处理
这是TEDLIUM数据集的一个变体,增加了使用Whisper模型生成的伪标签转录,并包含时间戳信息。伪标签转录是通过使用Whisper large-v2模型对输入音频数据进行贪婪采样和时间戳预测生成的。数据集的使用包括安装和加载数据集的指导,以及如何流式加载数据集。此外,还提供了如何使用该数据集进行Distil Whisper训练的指导。
Hugging Face
2023-09-25 更新
33
0
uniiiii/Whisper-fine-tune-p-29
语音识别
音频处理
该数据集包含音频和对应的文本转录。音频数据的采样率为16000Hz,文本转录为字符串类型。数据集仅包含一个训练集,大小为4393870054.624字节,包含32561个样本。下载大小为2127250473字节。
Hugging Face
2024-05-17 更新
12
0
MARBLEGenreClassification_MTG-Genre-Fold4
音乐类型分类
音频处理
# Dataset Card for "MARBLEGenreClassification_MTG-Genre-Fold4" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
魔搭社区
2025-11-02 更新
11
0
4eJIoBek/Old-audios-11k
音频处理
历史音频
该数据集包含未排序的音频文件,这些音频文件可能是mod、wav或其他旧音频格式。
Hugging Face
2023-10-01 更新
13
0
mask-distilled-libri-one-sec-cv12/chunk_261
音频处理
机器学习
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: logits sequence: float32 splits: - name: train num_bytes: 689367364.9479026
Hugging Face
2024-05-21 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广