tyzhu/lmind_nq_train300_eval100_v1_doc_qa
收藏资源简介:
--- configs: - config_name: default data_files: - split: train_qa path: data/train_qa-* - split: train_recite_qa path: data/train_recite_qa-* - split: eval_qa path: data/eval_qa-* - split: eval_recite_qa path: data/eval_recite_qa-* - split: all_docs path: data/all_docs-* - split: all_docs_eval path: data/all_docs_eval-* - split: train path: data/train-* - split: validation path: data/validation-* dataset_info: features: - name: answers struct: - name: answer_start sequence: 'null' - name: text sequence: string - name: inputs dtype: string - name: targets dtype: string splits: - name: train_qa num_bytes: 34574 num_examples: 300 - name: train_recite_qa num_bytes: 226733 num_examples: 300 - name: eval_qa num_bytes: 11254 num_examples: 100 - name: eval_recite_qa num_bytes: 74768 num_examples: 100 - name: all_docs num_bytes: 254478 num_examples: 392 - name: all_docs_eval num_bytes: 254451 num_examples: 392 - name: train num_bytes: 289052 num_examples: 692 - name: validation num_bytes: 11254 num_examples: 100 download_size: 756998 dataset_size: 1156564 --- # Dataset Card for "lmind_nq_train300_eval100_v1_doc_qa" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 默认配置:
- 数据文件路径:
train_qa:data/train_qa-*train_recite_qa:data/train_recite_qa-*eval_qa:data/eval_qa-*eval_recite_qa:data/eval_recite_qa-*all_docs:data/all_docs-*all_docs_eval:data/all_docs_eval-*train:data/train-*validation:data/validation-*
- 数据文件路径:
数据集信息
-
特征:
answers:answer_start:序列类型为nulltext:序列类型为string
inputs:数据类型为stringtargets:数据类型为string
-
分割:
train_qa:- 字节数:34574
- 样本数:300
train_recite_qa:- 字节数:226733
- 样本数:300
eval_qa:- 字节数:11254
- 样本数:100
eval_recite_qa:- 字节数:74768
- 样本数:100
all_docs:- 字节数:254478
- 样本数:392
all_docs_eval:- 字节数:254451
- 样本数:392
train:- 字节数:289052
- 样本数:692
validation:- 字节数:11254
- 样本数:100
-
数据集大小:
- 下载大小:756998 字节
- 数据集大小:1156564 字节



