Codec-SUPERB/dcase2016_task2_extract_unit
收藏资源简介:
--- configs: - config_name: default data_files: - split: academicodec_hifi_16k_320d path: data/academicodec_hifi_16k_320d-* - split: academicodec_hifi_16k_320d_large_uni path: data/academicodec_hifi_16k_320d_large_uni-* - split: academicodec_hifi_24k_320d path: data/academicodec_hifi_24k_320d-* - split: audiodec_24k_320d path: data/audiodec_24k_320d-* - split: dac_16k path: data/dac_16k-* - split: dac_24k path: data/dac_24k-* - split: dac_44k path: data/dac_44k-* - split: encodec_24k path: data/encodec_24k-* - split: funcodec_en_libritts_16k_gr1nq32ds320 path: data/funcodec_en_libritts_16k_gr1nq32ds320-* - split: funcodec_en_libritts_16k_gr8nq32ds320 path: data/funcodec_en_libritts_16k_gr8nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds320 path: data/funcodec_en_libritts_16k_nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds640 path: data/funcodec_en_libritts_16k_nq32ds640-* - split: funcodec_zh_en_16k_nq32ds320 path: data/funcodec_zh_en_16k_nq32ds320-* - split: funcodec_zh_en_16k_nq32ds640 path: data/funcodec_zh_en_16k_nq32ds640-* - split: speech_tokenizer_16k path: data/speech_tokenizer_16k-* dataset_info: features: - name: id dtype: string - name: unit sequence: sequence: int64 splits: - name: academicodec_hifi_16k_320d num_bytes: 13827534 num_examples: 72 - name: academicodec_hifi_16k_320d_large_uni num_bytes: 13827534 num_examples: 72 - name: academicodec_hifi_24k_320d num_bytes: 20739534 num_examples: 72 - name: audiodec_24k_320d num_bytes: 44241486 num_examples: 72 - name: dac_16k num_bytes: 84608718 num_examples: 72 - name: dac_24k num_bytes: 234909006 num_examples: 72 - name: dac_44k num_bytes: 69429102 num_examples: 72 - name: encodec_24k num_bytes: 10372110 num_examples: 72 - name: funcodec_en_libritts_16k_gr1nq32ds320 num_bytes: 110622030 num_examples: 72 - name: funcodec_en_libritts_16k_gr8nq32ds320 num_bytes: 110622030 num_examples: 72 - name: funcodec_en_libritts_16k_nq32ds320 num_bytes: 110622030 num_examples: 72 - name: funcodec_en_libritts_16k_nq32ds640 num_bytes: 55326030 num_examples: 72 - name: funcodec_zh_en_16k_nq32ds320 num_bytes: 110622030 num_examples: 72 - name: funcodec_zh_en_16k_nq32ds640 num_bytes: 110622030 num_examples: 72 - name: speech_tokenizer_16k num_bytes: 27657294 num_examples: 72 download_size: 175718409 dataset_size: 1128048498 --- # Dataset Card for "dcase2016_task2_extract_unit" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 数据拆分:academicodec_hifi_16k_320d,路径:data/academicodec_hifi_16k_320d-* - 数据拆分:academicodec_hifi_16k_320d_large_uni,路径:data/academicodec_hifi_16k_320d_large_uni-* - 数据拆分:academicodec_hifi_24k_320d,路径:data/academicodec_hifi_24k_320d-* - 数据拆分:audiodec_24k_320d,路径:data/audiodec_24k_320d-* - 数据拆分:dac_16k,路径:data/dac_16k-* - 数据拆分:dac_24k,路径:data/dac_24k-* - 数据拆分:dac_44k,路径:data/dac_44k-* - 数据拆分:encodec_24k,路径:data/encodec_24k-* - 数据拆分:funcodec_en_libritts_16k_gr1nq32ds320,路径:data/funcodec_en_libritts_16k_gr1nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_gr8nq32ds320,路径:data/funcodec_en_libritts_16k_gr8nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_nq32ds320,路径:data/funcodec_en_libritts_16k_nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_nq32ds640,路径:data/funcodec_en_libritts_16k_nq32ds640-* - 数据拆分:funcodec_zh_en_16k_nq32ds320,路径:data/funcodec_zh_en_16k_nq32ds320-* - 数据拆分:funcodec_zh_en_16k_nq32ds640,路径:data/funcodec_zh_en_16k_nq32ds640-* - 数据拆分:speech_tokenizer_16k,路径:data/speech_tokenizer_16k-* 数据集信息: 特征字段: - 名称:id,数据类型:字符串 - 名称:unit,结构:嵌套序列(内层序列元素为64位整型) 数据拆分信息: - 拆分名称:academicodec_hifi_16k_320d,字节占用:13827534,样本数量:72 - 拆分名称:academicodec_hifi_16k_320d_large_uni,字节占用:13827534,样本数量:72 - 拆分名称:academicodec_hifi_24k_320d,字节占用:20739534,样本数量:72 - 拆分名称:audiodec_24k_320d,字节占用:44241486,样本数量:72 - 拆分名称:dac_16k,字节占用:84608718,样本数量:72 - 拆分名称:dac_24k,字节占用:234909006,样本数量:72 - 拆分名称:dac_44k,字节占用:69429102,样本数量:72 - 拆分名称:encodec_24k,字节占用:10372110,样本数量:72 - 拆分名称:funcodec_en_libritts_16k_gr1nq32ds320,字节占用:110622030,样本数量:72 - 拆分名称:funcodec_en_libritts_16k_gr8nq32ds320,字节占用:110622030,样本数量:72 - 拆分名称:funcodec_en_libritts_16k_nq32ds320,字节占用:110622030,样本数量:72 - 拆分名称:funcodec_en_libritts_16k_nq32ds640,字节占用:55326030,样本数量:72 - 拆分名称:funcodec_zh_en_16k_nq32ds320,字节占用:110622030,样本数量:72 - 拆分名称:funcodec_zh_en_16k_nq32ds640,字节占用:110622030,样本数量:72 - 拆分名称:speech_tokenizer_16k,字节占用:27657294,样本数量:72 下载总大小:175718409 数据集总大小:1128048498 --- # “dcase2016_task2_extract_unit”数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 默认配置:
- 包含多个数据文件,每个文件对应不同的分割和路径:
academicodec_hifi_16k_320d:路径为data/academicodec_hifi_16k_320d-*academicodec_hifi_16k_320d_large_uni:路径为data/academicodec_hifi_16k_320d_large_uni-*academicodec_hifi_24k_320d:路径为data/academicodec_hifi_24k_320d-*audiodec_24k_320d:路径为data/audiodec_24k_320d-*dac_16k:路径为data/dac_16k-*dac_24k:路径为data/dac_24k-*dac_44k:路径为data/dac_44k-*encodec_24k:路径为data/encodec_24k-*funcodec_en_libritts_16k_gr1nq32ds320:路径为data/funcodec_en_libritts_16k_gr1nq32ds320-*funcodec_en_libritts_16k_gr8nq32ds320:路径为data/funcodec_en_libritts_16k_gr8nq32ds320-*funcodec_en_libritts_16k_nq32ds320:路径为data/funcodec_en_libritts_16k_nq32ds320-*funcodec_en_libritts_16k_nq32ds640:路径为data/funcodec_en_libritts_16k_nq32ds640-*funcodec_zh_en_16k_nq32ds320:路径为data/funcodec_zh_en_16k_nq32ds320-*funcodec_zh_en_16k_nq32ds640:路径为data/funcodec_zh_en_16k_nq32ds640-*speech_tokenizer_16k:路径为data/speech_tokenizer_16k-*
- 包含多个数据文件,每个文件对应不同的分割和路径:
数据集信息
-
特征:
id:类型为字符串unit:类型为整数序列
-
分割:
academicodec_hifi_16k_320d:字节数为 13827534,示例数为 72academicodec_hifi_16k_320d_large_uni:字节数为 13827534,示例数为 72academicodec_hifi_24k_320d:字节数为 20739534,示例数为 72audiodec_24k_320d:字节数为 44241486,示例数为 72dac_16k:字节数为 84608718,示例数为 72dac_24k:字节数为 234909006,示例数为 72dac_44k:字节数为 69429102,示例数为 72encodec_24k:字节数为 10372110,示例数为 72funcodec_en_libritts_16k_gr1nq32ds320:字节数为 110622030,示例数为 72funcodec_en_libritts_16k_gr8nq32ds320:字节数为 110622030,示例数为 72funcodec_en_libritts_16k_nq32ds320:字节数为 110622030,示例数为 72funcodec_en_libritts_16k_nq32ds640:字节数为 55326030,示例数为 72funcodec_zh_en_16k_nq32ds320:字节数为 110622030,示例数为 72funcodec_zh_en_16k_nq32ds640:字节数为 110622030,示例数为 72speech_tokenizer_16k:字节数为 27657294,示例数为 72
-
数据集大小:
- 下载大小:175718409 字节
- 数据集大小:1128048498 字节




