遇见数据集

AWeirdDev/screen-qa-full

收藏
Hugging Face2024-06-14 更新2024-06-29 收录
官方服务:

资源简介:

ScreenQA数据集来源于[github.com/google-research-datasets/screen_qa](https://github.com/google-research-datasets/screen_qa),并添加了Rico数据集的图像。该数据集包含图像、问题和真实答案三个特征,主要用于训练模型。

ScreenQA数据集来源于[github.com/google-research-datasets/screen_qa](https://github.com/google-research-datasets/screen_qa),并添加了Rico数据集的图像。该数据集包含图像、问题和真实答案三个特征,主要用于训练模型。

提供机构:
AWeirdDev
原始信息汇总

Screen-QA-Full 数据集概述

数据集信息

特征

  • image: 图像数据
  • question: 字符串类型的问题
  • ground_truth: 字符串类型的真实答案

数据分割

  • train: 训练集
    • 字节数: 8164044640.98
    • 样本数: 68980

数据大小

  • 下载大小: 2667555722
  • 数据集大小: 8164044640.98

配置

  • default: 默认配置
    • 数据文件路径: data/train-*
搜集汇总
数据集介绍
AWeirdDev/screen-qa-full 数据集图片
背景与挑战
背景概述
screen-qa-full是一个多模态屏幕问答数据集,包含约69,000行数据,总大小为2.67 GB,格式为parquet。数据集结合了图像(来自Rico数据集)和文本(问题与答案),用于训练模型基于屏幕截图理解内容并回答问题,支持视觉和语言任务的集成。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务