Saikumar3/your_dataset_name
收藏资源简介:
--- dataset_info: features: - name: message_id dtype: string - name: parent_id dtype: string - name: user_id dtype: string - name: created_date dtype: string - name: text dtype: string - name: role dtype: string - name: lang dtype: string - name: review_count dtype: int64 - name: review_result dtype: bool - name: deleted dtype: bool - name: rank dtype: float64 - name: synthetic dtype: bool - name: model_name dtype: float64 - name: detoxify dtype: string - name: message_tree_id dtype: string - name: tree_state dtype: string - name: emojis dtype: string - name: labels dtype: string splits: - name: train num_bytes: 52828840 num_examples: 22485 download_size: 23745150 dataset_size: 52828840 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集概述
数据集信息
特征
- message_id: 字符串类型
- parent_id: 字符串类型
- user_id: 字符串类型
- created_date: 字符串类型
- text: 字符串类型
- role: 字符串类型
- lang: 字符串类型
- review_count: 64位整数类型
- review_result: 布尔类型
- deleted: 布尔类型
- rank: 64位浮点数类型
- synthetic: 布尔类型
- model_name: 64位浮点数类型
- detoxify: 字符串类型
- message_tree_id: 字符串类型
- tree_state: 字符串类型
- emojis: 字符串类型
- labels: 字符串类型
数据分割
- train:
- 字节数: 52828840
- 样本数: 22485
数据集大小
- 下载大小: 23745150 字节
- 数据集大小: 52828840 字节
配置
- config_name: default
- data_files:
- split: train
- path: data/train-*
- data_files:



