AWeirdDev/screen-qa-full
收藏官方服务:
资源简介:
ScreenQA数据集来源于[github.com/google-research-datasets/screen_qa](https://github.com/google-research-datasets/screen_qa),并添加了Rico数据集的图像。该数据集包含图像、问题和真实答案三个特征,主要用于训练模型。
ScreenQA数据集来源于[github.com/google-research-datasets/screen_qa](https://github.com/google-research-datasets/screen_qa),并添加了Rico数据集的图像。该数据集包含图像、问题和真实答案三个特征,主要用于训练模型。
提供机构:
AWeirdDev原始信息汇总
Screen-QA-Full 数据集概述
数据集信息
特征
- image: 图像数据
- question: 字符串类型的问题
- ground_truth: 字符串类型的真实答案
数据分割
- train: 训练集
- 字节数: 8164044640.98
- 样本数: 68980
数据大小
- 下载大小: 2667555722
- 数据集大小: 8164044640.98
配置
- default: 默认配置
- 数据文件路径:
data/train-*
- 数据文件路径:
搜集汇总
数据集介绍

背景与挑战
背景概述
screen-qa-full是一个多模态屏幕问答数据集,包含约69,000行数据,总大小为2.67 GB,格式为parquet。数据集结合了图像(来自Rico数据集)和文本(问题与答案),用于训练模型基于屏幕截图理解内容并回答问题,支持视觉和语言任务的集成。
以上内容由遇见数据集搜集并总结生成



