相关数据集
AgriLiRa4D
AgriLiRa4D是由拓普枪机器人、杭州电子科技大学及南京大学联合创建的多模态无人机数据集,专为挑战性户外农业环境设计。该数据集规模宏大,涵盖平坦、丘陵和梯田三种典型农田类型以及边界与覆盖两种作业模式,共包含六组飞行序列,同步采集了三维激光雷达、四维雷达和惯性测量单元的高精度数据,并辅以厘米级精度的光纤惯性导航系统实时动态测量真值轨迹。数据集通过精心校准的传感器套件在真实农田场景中系统采集,旨在
arXiv2025-12-01 更新990
mair-lab/vismin
VisMin数据集由四种类型的最小变化组成——对象、属性、计数和空间关系——这些变化存在于两个图像-描述对之间。评估任务要求模型在给定两种情况下预测正确的图像-描述匹配:1)两张图片和一个描述,2)两个描述和一张图片。VisMin基准包含2,084个样本,分为579个对象、294个属性、589个计数和622个关系。
Hugging Face2024-11-28 更新160
Faster-RCNN features
Precomputed Faster RCNN features.We used pre-trained model provided by chainercv as a feature extractor.http://chainercv.readthedocs.io/en/stable/reference/links/faster_rcnn.html#chainercv.links.model
Figshare2018-06-28 更新40
LLaVA-CoT-Instruct-58K
该数据集包含多个特征,如id、问题、输出、真实答案、消息和图像。消息是一个列表,包含内容和角色两个字段。数据集包含一个训练分割,有58468个例子,总大小为4560434108字节。数据集来源于LLaVA-CoT-o1-Instruct。
Hugging Face2024-12-25 更新600
pixelprose-shards
pixelprose-shards是一个包含图像、文本和JSON文件三元组的数据集,分为commonpool、cc12m和redcaps三个部分。每个tar文件大小约为500-600MB,便于快速采样和加载。数据集总共有16,874,890个三元组,其中commonpool有6,521,737个,cc12m有9,066,468个,redcaps有1,286,685个。文本文件包含原始标题,JSON
Hugging Face2025-12-14 更新140



