登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Annotations corpus ANGLISH
Annotations corpus ANGLISH
收藏
DataCite Commons
2026-02-11 更新
2026-05-04 收录
语料标注
多语言处理
数据链接:
https://www.ortolang.fr/market/item/sldr000733/v2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Annotations du corpus ANGLISH(En préparation)
应用场景:
提供机构:
ORTOLANG (Open Resources and TOols for LANGuage) - www.ortolang.fr
创建时间:
2026-02-10
相关数据集
graelo/wikipedia
多语言处理
语言建模
该数据集是一个多语言的Wikipedia数据集,涵盖了多种语言。每个语言的配置信息包括特征(如id、url、title、text)、分割(如train)、下载大小和数据集大小等详细信息。数据集的任务类别包括文本生成和填充掩码,适用于语言建模和掩码语言建模任务。数据集的大小类别从小于1K到大于10M不等,涵盖了广泛的语言范围。
Hugging Face
2023-09-10 更新
38
0
xbilek25/validation_set_100_de_en
语音识别
多语言处理
--- dataset_info: features: - name: client_id dtype: string - name: path dtype: string - name: audio dtype: audio: sampling_rate: 48000 - name: sentence dtype:
Hugging Face
2024-04-28 更新
23
0
micsell/mixed_he_en
语音识别
多语言处理
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string - name: language dtype: string splits: - name: train
Hugging Face
2024-01-30 更新
8
0
severo/flores_101
机器翻译
多语言处理
FLORES是一个用于机器翻译的基准数据集,特别关注英语与低资源语言之间的翻译。该数据集包含101种语言的平行句子,这些句子是从英文维基百科中提取并由专业翻译人员翻译的。数据集的设计旨在更好地评估模型在低资源语言上的表现,并支持多对多的多语言翻译系统评估。数据集的结构包括数据实例、数据字段、数据分割等信息,所有句子在多语言配置和分割中都是对齐的。
Hugging Face
2022-10-27 更新
30
0
kardosdrur/scandi_eurovoc
多语言处理
文本分类
--- dataset_info: features: - name: title dtype: string - name: date dtype: string - name: eurovoc_concepts sequence: string - name: url dtype: string - name: lang dtyp
Hugging Face
2024-01-09 更新
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广