遇见数据集

nc33/triplet_sbert_law2

收藏
Hugging Face2023-08-20 更新2024-03-04 收录
官方服务:

资源简介:

该数据集名为triplet_sbert_law2,主要用于训练模型,包含问题、正面回答、负面回答和ID四个特征,所有特征的数据类型均为字符串。数据集仅包含训练集,共有335,510个示例,总大小为1,133,470,947字节。

该数据集名为triplet_sbert_law2,主要用于训练模型,包含问题、正面回答、负面回答和ID四个特征,所有特征的数据类型均为字符串。数据集仅包含训练集,共有335,510个示例,总大小为1,133,470,947字节。

提供机构:
nc33
原始信息汇总

数据集概述

数据集信息

  • 配置名称: train
  • 特征:
    • question: 数据类型为字符串
    • positive: 数据类型为字符串
    • negative: 数据类型为字符串
    • id: 数据类型为字符串
  • 分割:
    • train:
      • 字节数: 1133470947
      • 样本数: 335510
  • 下载大小: 93896594
  • 数据集大小: 1133470947

配置

  • 配置名称: train
  • 数据文件:
    • 分割: train
    • 路径: train/train-*
二维码
社区交流群
二维码
科研交流群
商业服务