登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Comparison of P-PCFL model and other models on VQA v2.0.
Comparison of P-PCFL model and other models on VQA v2.0.
收藏
NIAID Data Ecosystem
2026-03-13 收录
视觉问答
多模态模型
数据链接:
https://figshare.com/articles/dataset/Comparison_of_P-PCFL_model_and_other_models_on_VQA_v2_0_/19117701
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Comparison of P-PCFL model and other models on VQA v2.0.
应用场景:
创建时间:
2022-02-03
相关数据集
Visual Harmful Dataset 11K (VHD11K)
有毒内容检测
视觉问答
Visual Harmful Dataset 11K (VHD11K) 是由国立阳明交通大学和Netflix Eyeline Studios共同创建的综合性多模态有害内容数据集。该数据集包含10,000张图片和1,000个视频,涵盖10个有害类别,内容来源于互联网和4个生成模型。数据集的创建过程采用了多代理视觉问答(VQA)任务的注释框架,确保了注释的全面性和准确性。VHD11K旨在解决现有有害内
arXiv
2024-10-02 更新
540
0
CVasNLPExperiments/VQAv2_sample_validation_google_flan_t5_xxl_mode_D_PNP_GENERIC_Q_rices_ns_1000
图像描述
视觉问答
--- dataset_info: features: - name: id dtype: int64 - name: question dtype: string - name: true_label sequence: string - name: prediction dtype: string splits: - name: fe
Hugging Face
2023-05-26 更新
19
0
deepvk/LLaVA-Instruct-ru
视觉问答
复杂推理
LLaVA-Instruct-ru数据集是LLaVA instruct数据集的俄语版本,遵循原始管道生成数据,并收集了包含`conversation`和`complex_reasoning`类型的指令。每个数据行包含四个字段:`type`、`conversations`、`id`和`image`。`conversation`对话包含多个话语,人类提问并澄清之前的回答,GPT回答问题。`comple
Hugging Face
2024-05-22 更新
15
0
Nayana-cognitivelab/VQA-SFT-test
视觉问答
跨语言处理
这是一个包含图像和文本问题的多语言数据集,支持跨语言问答。数据集分为不同的配置,每个配置包含训练集。每种配置都有源语言和目标语言,以及描述性和多项选择题类型的问题。数据集还包括图像的源语言、问题语言和答案语言的信息。
Hugging Face
2025-08-05 更新
26
0
COCOVQA
视觉问答
机器学习
2017年4月: 完整版本 (2.0版) 平衡真实图像 204,721可可图像 (所有当前列车/val/测试) 1,105,904问题 11,059,040地面真相答案
OpenDataLab
2026-07-12 更新
19
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广