登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
中-西班牙语平行语料
中-西班牙语平行语料
收藏
合肥数据要素流通平台
2023-12-19 更新
2024-03-01 收录
机器翻译
语言学研究
数据链接:
https://www.bigdatadex.com.cn/dataCirculation/listMoreb/details?shopId=1736932336283545601&commodityType=2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
中-西班牙语平行语料
Chinese-Spanish Parallel Corpus
应用场景:
提供机构:
合肥群音信息服务有限公司
创建时间:
2023-12-19
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集是中-西班牙语平行语料,涵盖口语、通用、科技、政治、旅游等多个领域,准确率超过95%,包含超过1000万句语料。
以上内容由遇见数据集搜集并总结生成
相关数据集
Words.hk Cantonese-English Parallel Corpus
多语言学习
机器翻译
一个从words.hk提取的粤语-英语平行语料库。
github
2022-11-07 更新
78
0
Building Bridges: A Dataset for Evaluating Gender-Fair Machine Translation into German
机器翻译
性别公平
本研究介绍了名为‘Building Bridges’的数据集,旨在评估性别公平的英语到德语机器翻译。该数据集由格拉茨大学等机构创建,包含115个名词,涵盖职业和普通名词,用于测试性别中性词汇的翻译。数据集通过增强社区创建的性别公平语言词典,并从百科全书文本和议会演讲中抽样多句测试实例构建。此数据集的应用领域主要集中在解决机器翻译中的性别偏见问题,推动性别公平语言的使用。
arXiv
2024-06-10 更新
10
0
aloobun/indic-parallel-sentences-talks
机器翻译
多语言信息检索
该数据集包含多种语言的平行句子(即英语句子+其他语言的相同句子),适用于特征提取和句子相似性任务。数据集涵盖了孟加拉语(bn)、古吉拉特语(gu)、印地语(hi)、卡纳达语(kn)、马拉雅拉姆语(ml)、马拉地语(mr)、泰米尔语(ta)和泰卢固语(te)等多种语言。
Hugging Face
2024-12-19 更新
6
0
WMT14 en-de
机器翻译
自然语言处理
该数据集是专为英语和德语之间的机器翻译而设计的。它被用于训练用于机器翻译任务的Transformer-Base模型。该数据集的主要任务是机器翻译。
arXiv
13
0
michsethowusu/afrikaans-swahili_sentence-pairs
自然语言处理
机器翻译
非洲语言句子对数据集,包含句子对及其相似度评分,适用于机器翻译、句子对齐等自然语言处理任务。
Hugging Face
2025-04-03 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广