遇见数据集

FrancophonIA/NTEU_French-Slovenian

收藏
Hugging Face2025-03-29 更新2025-04-12 收录
官方服务:

资源简介:

这是一个用于NTEU项目(项目编号:2018-EU-IA-0051)构建机器翻译引擎的平行语料库资源汇编。该资源中的数据被编译为两个TMX文件,分为两个层级,按数据源可靠性分组。Tier A包括来自人工编辑源的数据,如翻译记忆库等。Tier B包括从各种网络和并行文档来源自动对齐的平行数据。

This is a compilation of parallel corpora resources used in building of Machine Translation engines in NTEU project (Action number: 2018-EU-IA-0051). Data in this resource are compiled in two TMX files, two tiers grouped by data source reliablity. Tier A -- data originating from human edited sources, translation memories and alike. Tier B -- data originating created by automatic aligning parallel data from miscellaneous web and parallel documents sources.

提供机构:
FrancophonIA
二维码
社区交流群
二维码
科研交流群
商业服务