相关数据集
aisc-team-b1/PMC-CaseReport
PMC-CaseReport数据集是一个用于视觉问答(VQA)任务的医学案例报告数据集,包含训练集和测试集,分别有316,838和120,836个样本。每个样本包含PMC_id、context、question、answer、inline和img_ref等特征。数据集中的文本部分和图像部分可以分别下载,图像部分以PMCxxxxxxx_figid.jpg的格式命名。数据集中的context字段包含案
Hugging Face2024-03-12 更新600
VQA-HAT 智能问答数据集
VQA-HAT 又称 VQA Human Attention,能根据所询问的问题评估图像的信息区域。康奈尔大学的团队通过让志愿者回答锐化模糊图像的区域,来获得人类视觉注意力图。
超神经2022-10-09 更新240
ntudlcv/dlcv_2024_final1
该数据集是一个视觉问答(Visual Question Answering)任务的数据集,主要涉及交通相关的主题。数据集包含id、image和conversations三个主要字段,其中conversations字段是一个包含from和value子字段的列表。数据集分为训练集、验证集和测试集,分别包含28810、8716和900个示例。数据集的总大小为29904366282.25字节,下载大小为2
Hugging Face2024-11-29 更新150
EgoThink 第一人称视角下视觉问答基准数据集
EgoThink 是由清华大学提出的一个基于第一人称视角的视觉问答基准数据集。该数据集包含 700 张图像,涵盖了 6 个核心能力,细分为 12 个维度。 EgoThink 的图像来源于 Ego4D 第一人称视频数据集的采样图片,为了确保数据的多样性,每个视频最多只采样 2 张图片。
超神经2024-04-11 更新370
asuglia/compguesswhat
--- annotations_creators: - machine-generated language_creators: - found language: - en license: - unknown multilinguality: - monolingual size_categories: - 100K<n<1M source_datasets: - extended|other
Hugging Face2024-02-07 更新150



