flaviagiammarino/vqa-rad
收藏资源简介:
VQA-RAD是一个关于放射学图像的问答对数据集,旨在用于训练和测试医学视觉问答系统。数据集包含开放式问题和二元“是/否”问题,来源于MedPix,一个免费的在线医学图像数据库,问答对由临床医生团队手动生成。数据集包含2,248个问答对和315张图像,分为训练集和测试集。数据集支持的任务包括在Papers with Code上的排行榜,模型根据“封闭式准确率”、“开放式准确率”和“总体准确率”进行排名。数据集的问答对为英文,发布在CC0 1.0通用许可证下。
VQA-RAD是一个关于放射学图像的问答对数据集,旨在用于训练和测试医学视觉问答系统。数据集包含开放式问题和二元“是/否”问题,来源于MedPix,一个免费的在线医学图像数据库,问答对由临床医生团队手动生成。数据集包含2,248个问答对和315张图像,分为训练集和测试集。数据集支持的任务包括在Papers with Code上的排行榜,模型根据“封闭式准确率”、“开放式准确率”和“总体准确率”进行排名。数据集的问答对为英文,发布在CC0 1.0通用许可证下。
数据集概述
数据集名称
- 名称: VQA-RAD
- 别名: 无
数据集基本信息
- 许可证: CC0-1.0
- 任务类别: 视觉问答
- 语言: 英语
- 标签: 医学
- 美观名称: VQA-RAD
- 大小类别: 1K<n<10K
数据集内容
- 类型: 医学视觉问答数据集
- 来源: 从MedPix数据库构建
- 生成方式: 由临床医生团队手动生成的问题-答案对
- 包含内容: 2,248个问题-答案对,315张图像
- 特殊说明: 训练集中有3个重复的图像-问题-答案三元组,且训练集与测试集共享1个图像-问题-答案三元组
数据集结构
- 特征:
image: 图像,数据类型为图像question: 问题,数据类型为字符串answer: 答案,数据类型为字符串
- 分割:
train: 1793个样本,95883938.139字节test: 451个样本,23818877.0字节
- 下载大小: 34496718字节
- 数据集大小: 119702815.139字节
数据集使用
- 支持任务: 医学视觉问答
- 评估指标: 闭合式准确率、开放式准确率和总体准确率
- 语言: 英语
数据集分割详情
| 训练集 | 测试集 | |
|---|---|---|
| QAs | 1,793 | 451 |
| 图像 | 313 | 203 |
法律与伦理
- 许可证: CC0 1.0 Universal License
引用信息
@article{lau2018dataset, title={A dataset of clinically generated visual questions and answers about radiology images}, author={Lau, Jason J and Gayen, Soumya and Ben Abacha, Asma and Demner-Fushman, Dina}, journal={Scientific data}, volume={5}, number={1}, pages={1--10}, year={2018}, publisher={Nature Publishing Group} }




