登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Freesound Prediction Data (2D Conv)
Freesound Prediction Data (2D Conv)
收藏
kaggle
2018-04-10 更新
2024-03-07 收录
音频处理
信号分析
数据链接:
https://www.kaggle.com/datasets/fizzbuzz/freesound-prediction-data-2d-conv
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
2-dimensional convolution on raw audio files
针对原始音频文件的二维卷积
应用场景:
创建时间:
2018-04-10
相关数据集
raw_GSG_dataset
音频处理
文本分析
该数据集包含音频文件及其对应的文本信息,适用于音频处理和文本分析任务。数据集分为训练集,共有230个样本,支持音频和文本字段,并提供每个样本的开始和结束时间信息。
Hugging Face
2025-08-12 更新
11
0
Alwaly/french_librispeech
语音识别
音频处理
该数据集包含音频和文本数据,特征包括文件路径、音频数据(采样率为16000Hz)、文本内容、说话者ID、章节ID和唯一ID。数据集仅包含训练集,大小为4194379926.256字节,包含17214个样本。
Hugging Face
2024-06-22 更新
9
0
Kyudan/MMAU-test
语音识别
音频处理
这是一个包含音频数据的多项选择题数据集,其中每个样本包括一个问题、多个选项和一个正确答案。数据集分为训练集,提供了每个样本的音频、问题文本、选项和答案等信息。此外,每个样本还标注有数据集名称、任务类型、类别、子类别和难度等元数据。
Hugging Face
2025-11-07 更新
7
0
talkpl-ai/TalkPlayData-Extra-audio-laion_clap
音频处理
机器学习
该数据集包含两个主要特征:id和embedding。id为字符串类型,用于唯一标识每个数据点;embedding为浮点数列表,可能表示文本或其他类型数据的向量表示。数据集仅包含一个训练集split,共有1,487,560个示例,总大小为6,137,672,560字节。提供的配置为默认配置,指定了训练数据文件的路径。
Hugging Face
2025-10-30 更新
10
0
ae-mask-distilled-libri-one-sec-cv12/chunk_12
音频处理
语音识别
该数据集包含音频数据和对应的浮点数序列。音频数据的采样率为16000Hz,浮点数序列用于表示音频的logits。数据集包含一个训练集,共有1041个样本,总大小为33373549.193571053字节。数据集的下载大小为29565582字节。数据集的配置文件指定了默认配置,数据文件路径为data/train-*。
Hugging Face
2024-07-01 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广