登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Freesound Prediction Data (2D Conv)
Freesound Prediction Data (2D Conv)
收藏
kaggle
2018-04-10 更新
2024-03-07 收录
音频处理
信号分析
数据链接:
https://www.kaggle.com/datasets/fizzbuzz/freesound-prediction-data-2d-conv
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
2-dimensional convolution on raw audio files
针对原始音频文件的二维卷积
应用场景:
创建时间:
2018-04-10
相关数据集
freesound-laion-640k
音频处理
机器学习
LAION-Audio-630K是一个大规模的音频-文本数据集,包含633,526对音频和文本,总时长为4,325.39小时。数据集包含人类活动、自然声音和音频效果等多种音频,来源于公开可用的网站。数据集由LAION组织收集,包含音频文件及其相关元数据,如标题、描述、标签、用户名、freesound_id、许可证类型等。数据集分为训练集和测试集,分别包含455019和50599个样本。音频文件遵循
Hugging Face
2024-09-01 更新
24
0
ae-mask-distilled-libri-one-sec-cv12/chunk_165
音频处理
机器学习
该数据集包含音频数据和对应的logits序列。音频数据的采样率为16000Hz,logits序列的数据类型为float32。数据集仅包含一个训练集(train),其中包含3386个样本,总大小为108552197.43013193字节。数据集的下载大小为97071968字节。
Hugging Face
2024-07-01 更新
10
0
FRESH Audio Dataset
音频处理
神经科学
References ---------- Appelhoff, S., Sanderson, M., Brooks, T., Vliet, M., Quentin, R., Holdgraf, C., Chaumon, M., Mikulan, E., Tavabi, K., Höchenberger, R., Welke, D., Brunner, C., Rockhill, A., Lars
OpenNeuro
2025-03-06 更新
9
0
mask-distilled-libri-one-sec-cv12/chunk_178
音频处理
机器学习
该数据集包含音频和logits两个主要特征,音频的采样率为16000,logits为float32类型的序列。数据集仅包含训练集,训练集大小为127499140.14065191字节,包含3977个样本。下载大小为112248862字节,数据集总大小为127499140.14065191字节。默认配置下的数据文件路径为data/train-*。
Hugging Face
2024-05-16 更新
15
0
tts-rj-hi-karya-44100hz-part-34
语音识别
音频处理
该数据集是一个包含音频数据和对应转录文本的数据集,适用于语音识别等任务。它包括一个训练集,共有大约10000个音频转录对,音频采样率为44100Hz。
Hugging Face
2025-03-29 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广