登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
char_voc.json
char_voc.json
收藏
kaggle
2020-05-04 更新
2024-03-08 收录
文本处理
数据清洗
数据链接:
https://www.kaggle.com/datasets/toby00/char-vocjson
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
char voc map tabel for specialed data
面向专用数据的字符(character)-词汇表(vocabulary)映射表格(table)
应用场景:
创建时间:
2020-05-04
相关数据集
doushabao4766/ontonotes_zh_ner
文本处理
实体识别
--- dataset_info: features: - name: id dtype: int64 - name: tokens sequence: string - name: ner_tags sequence: int64 splits: - name: train num_bytes: 7629700 num_exampl
Hugging Face
2023-05-26 更新
31
0
amuvarma/zuck-3-snacced
文本处理
编码
该数据集包含两个主要特征:transcript(文本转录)和codes_list(整数序列)。数据集仅包含一个训练集,共有972个样本,总大小为10034392字节,下载大小为2548150字节。数据文件路径为data/train-*。
Hugging Face
2024-12-15 更新
7
0
windfromthenorth/epsilon-forward-wm
文本处理
自然语言处理
这个数据集包含了查询(query)、完成(completion)和预测范围(horizon)三个字段。查询和完成字段是字符串类型,而预测范围是整型。数据集分为训练集,共有5310660个样本,总文件大小为9483298125字节。数据集的下载大小为371393452字节。
Hugging Face
2025-10-18 更新
6
0
danigambit/D_gen3_bench
文本处理
自然语言处理
该数据集包含两个主要特征:id和doc,分别表示数据的唯一标识符和文档内容。数据集被划分为一个训练集(train),包含1000个样本,总大小为580422字节。数据集的下载大小为358547字节。配置信息显示数据文件位于data/train-*路径下。
Hugging Face
2024-12-13 更新
15
0
lilyyellow/func_calling_v4.2
函数调用
文本处理
--- dataset_info: features: - name: keyword dtype: string - name: text dtype: string - name: response struct: - name: content dtype: string - name: task dtype:
Hugging Face
2024-05-07 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广