andrewsiah/test_pythia_7b
收藏资源简介:
--- dataset_info: features: - name: reward_1 dtype: float64 - name: reward_2 dtype: float64 - name: reward_3 dtype: float64 - name: reward_4 dtype: float64 - name: reward_5 dtype: float64 - name: reward_6 dtype: float64 - name: reward_7 dtype: float64 - name: reward_8 dtype: float64 - name: prompt dtype: string - name: subset dtype: string - name: id dtype: int64 - name: response_1 dtype: string - name: response_1_model dtype: string - name: response_2 dtype: string - name: response_2_model dtype: string - name: response_3 dtype: string - name: response_3_model dtype: string - name: response_4 dtype: string - name: response_4_model dtype: string - name: response_5 dtype: string - name: response_5_model dtype: string - name: response_6 dtype: string - name: response_6_model dtype: string - name: response_7 dtype: string - name: response_7_model dtype: string - name: response_8 dtype: string - name: response_8_model dtype: string - name: rformatted_promptresponse_1 dtype: string - name: rformatted_promptresponse_2 dtype: string - name: rformatted_promptresponse_3 dtype: string - name: rformatted_promptresponse_4 dtype: string - name: rformatted_promptresponse_5 dtype: string - name: rformatted_promptresponse_6 dtype: string - name: rformatted_promptresponse_7 dtype: string - name: rformatted_promptresponse_8 dtype: string splits: - name: train num_bytes: 684313 num_examples: 20 download_size: 614683 dataset_size: 684313 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征项: - 名称:reward_1,数据类型:64位浮点型 - 名称:reward_2,数据类型:64位浮点型 - 名称:reward_3,数据类型:64位浮点型 - 名称:reward_4,数据类型:64位浮点型 - 名称:reward_5,数据类型:64位浮点型 - 名称:reward_6,数据类型:64位浮点型 - 名称:reward_7,数据类型:64位浮点型 - 名称:reward_8,数据类型:64位浮点型 - 名称:prompt(提示词),数据类型:字符串型 - 名称:subset(子集),数据类型:字符串型 - 名称:id(样本编号),数据类型:64位整型 - 名称:response_1(回复1),数据类型:字符串型 - 名称:response_1_model(生成回复1的模型),数据类型:字符串型 - 名称:response_2(回复2),数据类型:字符串型 - 名称:response_2_model(生成回复2的模型),数据类型:字符串型 - 名称:response_3(回复3),数据类型:字符串型 - 名称:response_3_model(生成回复3的模型),数据类型:字符串型 - 名称:response_4(回复4),数据类型:字符串型 - 名称:response_4_model(生成回复4的模型),数据类型:字符串型 - 名称:response_5(回复5),数据类型:字符串型 - 名称:response_5_model(生成回复5的模型),数据类型:字符串型 - 名称:response_6(回复6),数据类型:字符串型 - 名称:response_6_model(生成回复6的模型),数据类型:字符串型 - 名称:response_7(回复7),数据类型:字符串型 - 名称:response_7_model(生成回复7的模型),数据类型:字符串型 - 名称:response_8(回复8),数据类型:字符串型 - 名称:response_8_model(生成回复8的模型),数据类型:字符串型 - 名称:rformatted_promptresponse_1,数据类型:字符串型 - 名称:rformatted_promptresponse_2,数据类型:字符串型 - 名称:rformatted_promptresponse_3,数据类型:字符串型 - 名称:rformatted_promptresponse_4,数据类型:字符串型 - 名称:rformatted_promptresponse_5,数据类型:字符串型 - 名称:rformatted_promptresponse_6,数据类型:字符串型 - 名称:rformatted_promptresponse_7,数据类型:字符串型 - 名称:rformatted_promptresponse_8,数据类型:字符串型 数据集划分: - 划分名称:train(训练集),字节大小:684313,样本数量:20 下载大小:614683,数据集总大小:684313 数据集配置: - 配置名称:default(默认配置),数据文件: - 对应train划分的数据文件路径为data/train-*
数据集信息
特征
- reward_1: 数据类型为
float64 - reward_2: 数据类型为
float64 - reward_3: 数据类型为
float64 - reward_4: 数据类型为
float64 - reward_5: 数据类型为
float64 - reward_6: 数据类型为
float64 - reward_7: 数据类型为
float64 - reward_8: 数据类型为
float64 - prompt: 数据类型为
string - subset: 数据类型为
string - id: 数据类型为
int64 - response_1: 数据类型为
string - response_1_model: 数据类型为
string - response_2: 数据类型为
string - response_2_model: 数据类型为
string - response_3: 数据类型为
string - response_3_model: 数据类型为
string - response_4: 数据类型为
string - response_4_model: 数据类型为
string - response_5: 数据类型为
string - response_5_model: 数据类型为
string - response_6: 数据类型为
string - response_6_model: 数据类型为
string - response_7: 数据类型为
string - response_7_model: 数据类型为
string - response_8: 数据类型为
string - response_8_model: 数据类型为
string - rformatted_promptresponse_1: 数据类型为
string - rformatted_promptresponse_2: 数据类型为
string - rformatted_promptresponse_3: 数据类型为
string - rformatted_promptresponse_4: 数据类型为
string - rformatted_promptresponse_5: 数据类型为
string - rformatted_promptresponse_6: 数据类型为
string - rformatted_promptresponse_7: 数据类型为
string - rformatted_promptresponse_8: 数据类型为
string
数据分割
- train: 包含 20 个样本,占用 684313 字节
数据集大小
- 下载大小: 614683 字节
- 数据集大小: 684313 字节
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- data_files:



