mazzaqq/llama7b_0.95_0.99
收藏资源简介:
--- dataset_info: features: - name: prompt list: - name: content dtype: string - name: role dtype: string - name: chosen list: - name: content dtype: string - name: role dtype: string - name: rejected list: - name: content dtype: string - name: role dtype: string splits: - name: train num_bytes: 156654752 num_examples: 59048 download_size: 9430713 dataset_size: 156654752 configs: - config_name: default data_files: - split: train path: data/train-* ---
The dataset includes three main features: prompt, chosen, and rejected. Each feature contains two sub-features: content and role, both of which are string types. The dataset is divided into a training set (train) with 59048 samples, totaling 156654752 bytes. The download size of the dataset is 9430713 bytes.
数据集概述
数据集特征
-
prompt
- content: 数据类型为字符串
- role: 数据类型为字符串
-
chosen
- content: 数据类型为字符串
- role: 数据类型为字符串
-
rejected
- content: 数据类型为字符串
- role: 数据类型为字符串
数据集分割
- train
- num_bytes: 156654752字节
- num_examples: 59048个示例
数据集大小
- download_size: 9430713字节
- dataset_size: 156654752字节
配置
- config_name: default
- data_files
- split: train
- path: data/train-*
- split: train
- data_files



