登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Yambda
Yambda
收藏
kaggle
2025-08-19 更新
2025-09-20 收录
多模态数据
信息检索
数据链接:
https://www.kaggle.com/datasets/ploshkin/yambda
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
A Large-Scale Multi-modal Dataset for Ranking And Retrieval
面向排序与检索的大规模多模态数据集
应用场景:
创建时间:
2025-08-19
相关数据集
Wikipedia_TF_IDF_Dataset
文本分析
信息检索
预计算的IDF统计数据覆盖所有英文维基百科文章。数据集包含压缩的CSV文件,每个文件解压后约为500MB,包含约1000万行的术语和词干。
github
2024-02-05 更新
22
0
jhu-clsp/mFollowIR-cross-lingual-parquet
信息检索
跨语言处理
mFollowIR跨语言数据集的Parquet版本,可以直接使用`load_dataset()`加载。该数据集包含多种配置,每种配置针对不同的目标语言(fas, rus, zho),包括原始和修改的相关性判断、文档集合、查询集以及排名靠前的文档。
Hugging Face
2024-10-24 更新
9
0
SamanthaZJQ/msmarco-passage-2.0
信息检索
自然语言处理
该数据集包含查询ID、查询文本、查询图片、正例文档ID序列、反例文档ID序列、答案和来源等字段。数据集分为训练集(train)、验证集(dev)、dl19和dl20四个部分,适用于文本和图像的联合处理任务。
Hugging Face
2025-02-04 更新
5
0
irds/lotte_pooled_dev_search
信息检索
搜索技术
`lotte/pooled/dev/search`数据集由ir-datasets包提供,主要用于文本检索任务。该数据集包含2,931个查询(即主题)和8,573个相关性评估。文档部分需要使用`irds/lotte_pooled_dev`数据集。
Hugging Face
2023-01-05 更新
17
0
Intelligent-Internet/II-Search-CIR-SFT
文本处理
信息检索
这是一个包含问题和原始文本的数据集,可能用于问答或文本处理相关任务。数据集划分为训练集,包含85636个样本,总大小为2.75GB。
Hugging Face
2025-08-05 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广