登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
iejMac/CLIP-MSVD
iejMac/CLIP-MSVD
收藏
Hugging Face
2022-11-05 更新
2024-03-04 收录
视频描述
多模态学习
数据链接:
https://hf-mirror.com/datasets/iejMac/CLIP-MSVD
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: mit ---
许可证:MIT许可证(MIT License)
应用场景:
提供机构:
iejMac
原始信息汇总
数据集概述
许可证信息
许可证类型:MIT
相关数据集
高质量通用图文数据集
多模态学习
人工智能
高质量通用图文数据集覆盖了各类图像数据以及对应的高质量文本描述,助力于人工智能研究,为图像和文本的多模态学习提供丰富的数据基础,有助于开发更先进的人工智能模型。对于图像描述生成,在图像描述生成领域,它可以让模型学习到如何准确、生动且富有逻辑性地描述一幅图像的内容;对于文本到图像生成方面,为模型提供丰富的参考和灵感,从而生成更符合文本描述、更具创意和艺术感的生动图像。在图像识别方面,能够帮助模型更精
北京市数据知识产权
2024-09-06 更新
577
0
OpenAI-CLIP weights
多模态学习
预训练模型
OpenAI's CLIP - pretrained weights
kaggle
2022-08-04 更新
48
0
VALUE (Video-And-Language Understanding Evaluation)
视频理解
多模态学习
VALUE 是一个视频和语言理解评估基准,用于测试可推广到不同任务、领域和数据集的模型。它是 11 个 VidL(视频和语言)数据集的集合,涵盖 3 个流行任务:(i)文本到视频检索; (ii) 视频问答; (iii) 视频字幕。 VALUE 基准旨在涵盖广泛的视频类型、视频长度、数据量和任务难度级别。 VALUE 不只关注具有视觉信息的单通道视频,而是推广利用来自视频帧及其相关字幕的信息的模型,
OpenDataLab
2026-07-12 更新
34
0
TravelQA
旅行问答
多模态学习
TravelQA是一个大规模的多模态旅行问答数据集,包含265K个问答对:160K个基于文本的问答,来自真实的旅行来源;100K个视觉语言问答,包含地图和位置图像;5K个专家标注的链式推理示例。数据集覆盖全球35+个城市。
github
2026-01-21 更新
58
0
IndoMER DATASET
情感识别
多模态学习
IndoMER DATASET是第一个全面的印尼多模态情感识别基准数据集。该数据集包含1944个时间对齐的社交媒体视频片段,经过精心标注,涵盖文本、音频和视觉模态的七种情感,并具有详细记录的长尾类别分布,以反映现实世界的挑战。
github
2025-12-23 更新
47
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广