登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Video_v2_AIC2024
Video_v2_AIC2024
收藏
kaggle
2024-09-18 更新
2025-01-04 收录
多模态视频处理
音频视频融合
数据链接:
https://www.kaggle.com/datasets/tienanh2003/video-v2-aic2024
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
AI Challenge 2024 - Preliminary Round: Video with audio Data Phase 2
AI 挑战 2024 - 初赛阶段:带音频的视频数据第二阶段
应用场景:
创建时间:
2024-09-18
相关数据集
MEVA
人类活动检测
多模态视频处理
MEVA数据集是由Kitware公司创建的一个大规模多视角、多模态视频数据集,旨在支持人类活动检测的研究。该数据集包含超过9300小时的未修剪连续视频,涵盖了多样化的同步活动,包括自发背景活动。数据集内容丰富,包括38个RGB和热红外摄像头的视频、42小时的无人机拍摄视频以及演员的GPS位置数据。创建过程中,数据集通过严格的IRB监督和批准,确保了数据收集的合法性和伦理性。MEVA数据集主要应用于
arXiv
2020-12-02 更新
137
0
Multimodal Objectifying Gaze (MObyGaze)
多模态视频处理
对象识别
MObyGaze数据集由蔚蓝海岸大学等研究机构创建,旨在通过专家对电影中的物化程度和概念进行密集标注,以分析视觉、语音和音频中的物化现象。数据集包含20部电影,总计43小时的视频内容,被划分为6072个片段,并由两位专家进行了标注。数据集的创建基于电影研究和心理学的理论,通过构建一个涉及5个子构造和11个概念的物化词汇表,对电影中的物化现象进行了深入分析。
arXiv
2025-05-28 更新
36
0
"SynMultiVid: A Synthetic Multi-Modal Video Dataset for Cross-Modal Correspondence Evaluation"
多模态视频处理
跨模态对应性评估
"This dataset provides synchronized multi-modal videos with ground-truth correspondences for evaluating cross-modal video matching and registration methods. Starting from standard RGB videos, four com
DataCite Commons
2025-10-05 更新
6
0
M2VD
多模态视频处理
多媒体分析
多模态多场景视频数据集
github
2025-03-05 更新
87
0
XD-Violence
暴力监测
多模态视频处理
暴力检测已在计算机视觉中研究多年。然而,以前的工作要么是肤浅的,例如短片分类和单一场景,要么供应不足,例如单一模态和基于手工制作的多模态特征。为了解决这个问题,在这项工作中,我们首先发布了一个名为 XD-Violence 的大规模多场景数据集,总时长为 217 小时,包含 4754 个带有音频信号和弱标签的未修剪视频。然后我们提出了一个包含三个并行分支的神经网络来捕获视频片段之间的不同关系并整合特
OpenXLab
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广