Wexler/llawma-fact-enrich
收藏官方服务:
资源简介:
该数据集是从公共查询中提取的样本数据集,用于Wexler事实丰富任务。任务要求从文档中提取描述事实的源文本,并从中提取相关信息。数据集包含关于该事实的多个字段,如描述、主题、主体和事件日期。例如,给定一个描述事实的源文本,数据集会提取出该事实的描述、主题、主体和事件日期等信息。
该数据集是从公共查询中提取的样本数据集,用于Wexler事实丰富任务。任务要求从文档中提取描述事实的源文本,并从中提取相关信息。数据集包含关于该事实的多个字段,如描述、主题、主体和事件日期。例如,给定一个描述事实的源文本,数据集会提取出该事实的描述、主题、主体和事件日期等信息。
提供机构:
Wexler原始信息汇总
数据集概述
基本信息
- 许可证: cc-by-nc-nd-4.0
- 任务类别: 特征提取
- 语言: 英语
- 标签: 法律
- 数据集大小: 小于1K
数据内容
- 来源: 公共查询样本
- 任务描述: 从文档中提取描述事实的源文本,例如: About $1.75 billion of Enrons $3.5 billion in syndicated bank loans come due in May 2002 and will likely need to be restructured.
数据字段
- description: Enrons $1.75 billion syndicated bank loans due in May 2002 likely need restructuring
- topic: Enrons Syndicated Bank Loan Restructuring
- subject: Enron
- date_of_event: May 2002
搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是一个小规模的法律文本数据集,专门用于事实提取和丰富任务,包含500行英文数据,结构化字段包括事实描述、主题、主体和事件日期。它从公共调查文档中提取,旨在支持模型训练,以自动从文本中提炼关键事实信息,适用于特征提取和自然语言处理应用。
以上内容由遇见数据集搜集并总结生成



