shidowake/FreedomIntelligence_alpaca-gpt4-japanese_subset_split_7
收藏数据链接:
官方服务:
资源简介:
--- dataset_info: features: - name: id dtype: string - name: conversations list: - name: from dtype: string - name: value dtype: string splits: - name: train num_bytes: 4863217.322740098 num_examples: 4997 download_size: 2456445 dataset_size: 4863217.322740098 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息(dataset_info): 特征字段: - 名称:id,数据类型:字符串(string) - 名称:conversations,数据类型为列表,列表元素为包含from与value两个子字段的字典,且两个子字段的数据类型均为字符串(string) 数据集划分: - 划分集名称:train,占用字节数:4863217.322740098,样本数量:4997 下载大小:2456445 数据集总大小:4863217.322740098 配置项: - 配置名称:default,数据文件: - 对应划分集:train,文件路径:data/train-*
提供机构:
shidowake原始信息汇总
数据集概述
特征信息
- id: 数据类型为字符串。
- conversations: 列表类型,包含以下字段:
- from: 数据类型为字符串。
- value: 数据类型为字符串。
数据分割
- train:
- 字节数: 4863217.322740098
- 样本数: 4997
数据大小
- 下载大小: 2456445
- 数据集大小: 4863217.322740098
配置信息
- default:
- 数据文件路径:
data/train-*
- 数据文件路径:



