登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
多语言翻译-文本翻译-语言翻译-在线翻译-自动翻译-机器翻译-实时翻译
多语言翻译-文本翻译-语言翻译-在线翻译-自动翻译-机器翻译-实时翻译
收藏
华为云市场
2026-06-08 更新
2025-09-21 收录
机器翻译
多语言处理
数据链接:
https://marketplace.huaweicloud.com/contents/016b9c91-c6d5-4b2e-b7a2-fae7350ee9ba
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
多语言翻译服务,支持100+种语言的智能翻译,基于先进的机器翻译技术,提供准确、快速的文本翻译服务,广泛应用于国际化业务、跨境电商、内容本地化等场景。
应用场景:
提供机构:
中科华霆(北京)科技有限公司
创建时间:
2025-09-17
相关数据集
Yujivus/wmt14-de-en-xlm-r-tokenized-128
机器翻译
这是一个包含文本输入和标签的数据集,适用于机器学习模型训练。数据集分为训练集、验证集和测试集,包含输入ID、注意力掩码、标签、输入长度和标签长度等字段。输入ID和注意力掩码是整数列表,标签、输入长度和标签长度是整数类型。训练集包含4489641个样本,验证集包含2995个样本,测试集包含3003个样本。
Hugging Face
2025-09-23 更新
7
0
EmakhuwaPortuguese parallel corpus
机器翻译
低资源语言
EmakhuwaPortuguese parallel corpus是由卢里奥大学和剑桥大学合作创建的一个包含47,415对葡萄牙语和Emakhuwa语句子的数据集。该数据集主要来源于耶和华见证人网站、非洲故事书网站以及莫桑比克法律文件等,总计包含699,976个Emakhuwa单词和877,595个葡萄牙语单词。数据集的创建过程涉及文本的数字化和光学字符识别(OCR)处理。该数据集主要用于机器翻
arXiv
2021-04-13 更新
6
0
wmt24-all_r_r-prefs
机器翻译
翻译质量评估
该数据集包含了多种语言对的翻译质量评估数据,每个语言对都有自己的配置和特征。特征包括各种指标,如BERTScore、BLEU、BLEURT20、CHRF、CHRFS、COMET22、COMETKiwi、Delta Length、GEMBA ESA、Human、METAMetrics MT、MEE4、MetricX-24、Post-edit、PPL、Sentinel、SPBLEU、XCOMET及其各
Hugging Face
2025-05-23 更新
5
0
Parallel Corpus for Indigenous Language Translation: Spanish-Mazatec and Spanish-Mixtec
机器翻译
土著语言
本研究介绍了首个针对墨西哥两种土著语言Mazatec和Mixtec与西班牙语的平行语料库,旨在支持机器翻译任务。该数据集包含9799句Mazatec语和13235句Mixtec语,主要来源于宗教和宪法领域。数据集的创建过程涉及文本对齐和预处理,以确保数据质量。此数据集的应用领域主要集中在提升低资源语言的机器翻译性能,特别是在从西班牙语翻译到土著语言的方向上显示出较好的效果。
arXiv
2023-05-27 更新
7
0
zh-tw-llm-dv/zh-tw-pythia-ta8000-v1-e1-tr_sg-302-c1024
机器翻译
语言模型
--- dataset_info: dataset_size: 447310289.2648228 download_size: 178540815 features: - name: input_ids sequence: int32 - name: attention_mask sequence: int8 - name: labels sequ
Hugging Face
2023-05-19 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广