hippocrates/clinical_train
收藏官方服务:
资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: valid path: data/valid-* dataset_info: features: - name: id dtype: string - name: conversations list: - name: from dtype: string - name: value dtype: string - name: text dtype: string splits: - name: train num_bytes: 52143984 num_examples: 10000 - name: valid num_bytes: 46961044 num_examples: 8164 download_size: 42209790 dataset_size: 99105028 --- # Dataset Card for "clinical_train" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
提供机构:
hippocrates原始信息汇总
数据集概述
配置
- 默认配置 (
default)- 数据文件路径:
- 训练集 (
train):data/train-* - 验证集 (
valid):data/valid-*
- 训练集 (
- 数据文件路径:
数据集信息
-
特征:
id: 数据类型为字符串 (string)conversations: 列表类型,包含以下子特征:from: 数据类型为字符串 (string)value: 数据类型为字符串 (string)
text: 数据类型为字符串 (string)
-
数据分割:
- 训练集 (
train):- 字节数: 52143984
- 样本数: 10000
- 验证集 (
valid):- 字节数: 46961044
- 样本数: 8164
- 训练集 (
-
数据集大小:
- 下载大小: 42209790 字节
- 数据集总大小: 99105028 字节



