登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
LazyAGI/CMRC2018_Knowledge_Base
LazyAGI/CMRC2018_Knowledge_Base
收藏
Hugging Face
2025-03-16 更新
2025-11-01 收录
机器阅读理解
知识问答
数据链接:
https://hf-mirror.com/datasets/LazyAGI/CMRC2018_Knowledge_Base
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证(MIT License)
应用场景:
提供机构:
LazyAGI
相关数据集
CMRC 2019
机器阅读理解
自然语言处理
CMRC 2019是由哈尔滨工业大学社会计算与信息检索研究中心和科大讯飞认知智能国家重点实验室联合创建的中文机器阅读理解数据集,包含超过10万个空白(问题)分布在1万多篇源自中文叙事故事的文本中。数据集通过精心设计,引入了假候选句子以增加难度,要求机器在填充空白时进行句子级别的推理并识别真假句子。该数据集主要用于评估和提升机器在处理复杂语言理解任务时的能力,特别是在需要综合多线索进行推理的场景中。
arXiv
2020-11-02 更新
92
0
PALRACE
机器阅读理解
可解释性
PALRACE是一个包含800篇阅读理解文章的数据集,由浙江大学创建,旨在提升机器阅读理解(MRC)任务的可解释性。该数据集的特点是每篇文章都附有人类标注的词级理由(rationale),这些理由由至少26名读者标注,用于支持答案的选择。数据集中的文章来自RACE数据集,涵盖多种问题类型,如因果、事实、推理等。PALRACE的创建不仅支持了理由的监督学习,还为评估模型在定位和解释信息方面的能力提供
arXiv
2022-03-24 更新
24
0
irds/mmarco_pt_dev
机器阅读理解
自然语言处理
`mmarco/pt/dev`数据集由ir-datasets包提供,主要用于文本检索任务。数据集中包含101,619条查询(queries)和59,273条相关性评估(qrels)。文档数据需要使用`irds/mmarco_pt`数据集。该数据集用于`mmarco_pt_dev_v1.1`版本。
Hugging Face
2023-01-05 更新
16
0
维基百科(wiki2019zh)
自然语言处理
知识问答
包含104万个结构良好的中文词条,可用于预训练语料或构建词向量,也适用于构建知识问答。数据集结构包括id、url、title和text,其中title是词条标题,text是正文。
github
2020-08-01 更新
50
0
NewsQA
机器阅读理解
自然语言处理
NewsQA是由Maluuba Research在加拿大蒙特利尔创建的一个大规模机器理解数据集,包含超过119,633个人类生成的问题-答案对,基于12,744篇CNN新闻文章。该数据集通过四阶段过程收集,旨在鼓励探索性问题,需要推理能力。数据集中的答案是从相应文章中提取的文本片段。NewsQA的应用领域主要集中在机器阅读理解,旨在通过复杂的问题解决机器理解文本的挑战。
arXiv
2017-02-08 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广