unaidedelf87777/hermes-orca-math
收藏资源简介:
--- dataset_info: features: - name: conversations list: - name: from dtype: string - name: value dtype: string - name: weight dtype: float64 - name: source dtype: string - name: id dtype: string - name: language dtype: string - name: model_name dtype: string - name: custom_instruction dtype: bool - name: system_prompt dtype: string - name: avatarUrl dtype: string - name: hash sequence: int64 - name: title dtype: string - name: skip_prompt_formatting dtype: bool - name: model dtype: string - name: category dtype: string - name: idx dtype: string - name: views dtype: float64 - name: topic dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 1904832285 num_examples: 1153735 download_size: 869340338 dataset_size: 1904832285 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集信息: 特征列表: - 字段名:conversations(对话),类型为列表,包含子字段: - 子字段名:from,数据类型:字符串(string) - 子字段名:value,数据类型:字符串(string) - 子字段名:weight,数据类型:64位浮点型(float64) - 字段名:source,数据类型:字符串(string) - 字段名:id,数据类型:字符串(string) - 字段名:language,数据类型:字符串(string) - 字段名:model_name,数据类型:字符串(string) - 字段名:custom_instruction,数据类型:布尔型(bool) - 字段名:system_prompt,数据类型:字符串(string) - 字段名:avatarUrl,数据类型:字符串(string) - 字段名:hash,数据类型:64位整型(int64)序列 - 字段名:title,数据类型:字符串(string) - 字段名:skip_prompt_formatting,数据类型:布尔型(bool) - 字段名:model,数据类型:字符串(string) - 字段名:category,数据类型:字符串(string) - 字段名:idx,数据类型:字符串(string) - 字段名:views,数据类型:64位浮点型(float64) - 字段名:topic,数据类型:字符串(string) - 字段名:__index_level_0__,数据类型:64位整型(int64) 数据集划分: - 划分名称:train(训练集),字节占用量:1904832285,样本总数:1153735 下载总大小:869340338,数据集存储总大小:1904832285 数据集配置: - 配置名称:default(默认配置),数据文件信息: - 对应划分:train(训练集),文件路径:data/train-*
数据集概述
数据集特征
- conversations
- from: 数据类型为字符串
- value: 数据类型为字符串
- weight: 数据类型为浮点数
- source: 数据类型为字符串
- id: 数据类型为字符串
- language: 数据类型为字符串
- model_name: 数据类型为字符串
- custom_instruction: 数据类型为布尔值
- system_prompt: 数据类型为字符串
- avatarUrl: 数据类型为字符串
- hash: 数据类型为整数序列
- title: 数据类型为字符串
- skip_prompt_formatting: 数据类型为布尔值
- model: 数据类型为字符串
- category: 数据类型为字符串
- idx: 数据类型为字符串
- views: 数据类型为浮点数
- topic: 数据类型为字符串
- index_level_0: 数据类型为整数
数据集分割
- train
- num_bytes: 1904832285 字节
- num_examples: 1153735 个示例
数据集大小
- download_size: 869340338 字节
- dataset_size: 1904832285 字节
配置
- config_name: default
- data_files
- split: train
- path: data/train-*
- split: train
- data_files



