VLM2Vec/B3-2b
收藏官方服务:
资源简介:
该数据集包含多个不同类型的视觉问答和图像处理相关的子数据集,例如A-OKVQA、CIRR、ChartQA等。每个子数据集都包含训练集信息,包括数据集的字节数和示例数量。这些数据集可能用于训练机器学习模型以理解和生成有关图像和图表的问答。
The dataset consists of multiple sub-datasets related to visual question answering and image processing tasks, such as A-OKVQA, CIRR, ChartQA, etc. Each sub-dataset contains training set information, including the number of bytes and examples. These datasets may be used to train machine learning models to understand and generate questions and answers about images and charts.
提供机构:
VLM2Vec搜集汇总
数据集介绍

背景与挑战
背景概述
VLM2Vec/B3-2b是一个文本模态的嵌入数据集,采用parquet格式,规模在百万到千万行级别,总行数超过100万。该数据集包含多个视觉问答(VQA)子集,如A-OKVQA、MSCOCO等,用于训练和评估视觉语言模型的表示学习能力,支持图像和文本的联合嵌入任务。
以上内容由遇见数据集搜集并总结生成



