登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Drawing with LLMs
Drawing with LLMs
收藏
kaggle
2025-04-08 更新
2025-06-07 收录
视觉语言模型
创意生成
数据链接:
https://www.kaggle.com/datasets/josepart/drawing-with-llms
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Descriptions and QA sets for the Drawing with LLMs competition
大语言模型绘作竞赛的描述与问答集
应用场景:
创建时间:
2025-04-08
相关数据集
FinChart-Bench
金融图表理解
视觉语言模型
FinChart-Bench是一个专注于现实世界金融图表的大型视觉语言模型理解基准数据集。该数据集包含从2015年到2024年收集的1200个金融图表图像,每个图像都标注了True/False、Multiple Choice和Question Answering三种类型的问题,共计7016个问题。FinChart-Bench旨在解决当前大型视觉语言模型在金融图表理解任务中的能力不足问题。数据集的创
arXiv
2025-07-20 更新
110
0
CodeResearch/CodeJudge-Eval
代码理解
视觉语言模型
--- license: mit language: - code - en ---
Hugging Face
2024-08-21 更新
26
0
TimeAware
时间敏感信息
视觉语言模型
TimeAware数据集是一个用于测试大型语言模型(LLMs)处理时间敏感事实能力的基准数据集。它包含1,150个来自可信来源的事件,每个事件都标有确切的月份和年份,并附有四个不同的表述方式。数据集涵盖了从政治到科学的广泛领域,旨在评估模型在不同时间背景下对信息的跟踪能力。此外,数据集的设计考虑了实际应用,如虚拟助手、事实核查系统和时间相关的问题回答。
Hugging Face
2024-09-20 更新
9
0
VALSE
视觉语言模型
零样本评估
VALSE是由海德堡大学计算语言学系创建的一个新型基准数据集,旨在测试预训练的视觉和语言(V&L)模型对特定语言现象的视觉语言基础能力。VALSE包含六个测试,覆盖了各种语言结构,要求模型在视觉模态中定位语言现象,实现比以往更细致的评估。数据集构建过程中采用了支持有效干扰项构建的方法,并报告了对五种广泛使用的V&L模型进行评估的结果。VALSE数据集利用现有的高质量图像描述和视觉问答数据,设计用于
arXiv
2022-03-14 更新
61
0
cx-cmu/Researchy-GEO
生成式搜索引擎优化
视觉语言模型
这是与**AutoGEO**一起发布的用于**生成引擎优化(GEO)**研究的研究领域数据集。它包括多个配置,如main、rule_candidate、cold_start、inference、grpo_input和grpo_eval,每个配置用于不同的目的,如训练、评估和推理。该数据集与题为生成搜索引擎喜欢什么以及如何协作优化网络内容的论文相关联,并标记用于文本生成和生成搜索等任务。
Hugging Face
2025-12-17 更新
23
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广