登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
篇章对齐数据集
篇章对齐数据集
收藏
合肥数据要素流通平台
2024-12-05 更新
2024-12-24 收录
机器翻译
自然语言处理
数据链接:
https://www.bigdatadex.com.cn/dataCirculation/listMoreb/details?shopId=1864558107172139010&commodityType=2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
数据为篇章对齐数据。主要为通过双语语料提升机器翻译引擎的用户使用; 还可以根据您的需求定制数据。
应用场景:
提供机构:
合肥易联语数科技有限公司
创建时间:
2024-12-05
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集为篇章对齐数据,主要用于提升机器翻译引擎性能,属于人工智能领域,支持定制化需求。
以上内容由遇见数据集搜集并总结生成
相关数据集
arthurmluz/GPTextSum_data-temario_results
文本摘要
自然语言处理
--- dataset_info: features: - name: id dtype: int64 - name: text dtype: string - name: summary dtype: string - name: gen_summary dtype: string - name: rouge struct:
Hugging Face
2023-11-15 更新
14
0
plutokokoa/translation-for-yu-gi-oh-ja-traditional-zh
机器翻译
自然语言处理
该数据集包含日语和中文的文本对,主要用于训练目的。数据集包含10536个样本,总大小为7474238字节。
Hugging Face
2024-02-17 更新
13
0
zhan1993/mathqa_lora_soup_repo
数学问答
自然语言处理
这是一个包含四个字段的数据集:指令(instruction)、输入(input)、输出(output)和答案(answer),所有字段均为文本类型。数据集包含一个训练集,大小为286,917,563字节,共有395,000个示例。数据集的下载大小为142,874,579字节。
Hugging Face
2025-03-31 更新
9
0
kevin017/tokenized_bioS_inverse_QA_major_large_padding
生物信息学
自然语言处理
该数据集是一个包含input_ids,attention_mask和answers_tokenized三个特征的自然语言处理数据集。它被分为训练集和测试集,每个集合都包含35个示例。数据集的下载大小为489489字节,总大小为5365030字节。
Hugging Face
2025-04-03 更新
14
0
prepro-temporal
图像处理
自然语言处理
该数据集包含id、图片、内容类型、转换文本和文档id等字段。数据集划分为训练集,共有11353个示例,总大小约为385MB。提供了默认配置,用于指定训练数据文件的路径。
Hugging Face
2025-08-22 更新
11
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广