MikeGreen2710/data_pred_3_models_batch_1
收藏资源简介:
--- dataset_info: features: - name: index dtype: string - name: text dtype: string - name: updated_at dtype: timestamp[ns] - name: post_date dtype: string - name: address dtype: string - name: NUM sequence: string - name: WAR sequence: string - name: CIT sequence: string - name: LAN sequence: string - name: STR sequence: string - name: LOC sequence: string - name: DIS sequence: string - name: LEG sequence: string - name: FWD sequence: string - name: FDR sequence: string - name: SHP sequence: string - name: LIV sequence: string - name: RWD sequence: string - name: PUR sequence: string - name: ARA sequence: string - name: CAR sequence: string - name: COR sequence: string - name: STU sequence: string - name: NOBA sequence: string - name: PRI sequence: string - name: RPI sequence: string - name: YCT sequence: string - name: NOF sequence: string - name: NOBR sequence: string splits: - name: train num_bytes: 880808101 num_examples: 800000 download_size: 426279441 dataset_size: 880808101 configs: - config_name: default data_files: - split: train path: data/train-* ---
数据集概述
数据集特征
- index: 数据类型为字符串
- text: 数据类型为字符串
- updated_at: 数据类型为时间戳(纳秒)
- post_date: 数据类型为字符串
- address: 数据类型为字符串
- NUM 至 NOBR: 这些特征的数据类型为字符串,且为序列类型
数据集划分
- train: 包含800000个样本,数据大小为880808101字节
数据集大小
- 下载大小: 426279441字节
- 数据集大小: 880808101字节
配置信息
- config_name: default
- data_files:
- split: train
- path: data/train-*



