遇见数据集

milos-andric/ruscifact_with_ruscibench

收藏
Hugging Face2025-01-19 更新2025-02-15 收录
官方服务:

资源简介:

该数据集包含三个部分:corpus、default和queries。corpus部分是一个大型的文本集合,default部分包含查询和相应的corpus标识及评分,queries部分是查询的集合。具体来说,corpus部分包含182268条文本数据,default部分包含1128条测试数据,queries部分也包含1128条查询数据。

The dataset consists of three parts: corpus, default, and queries. The corpus part is a large collection of texts, the default part contains queries along with corresponding corpus identifiers and scores, and the queries part is a collection of queries. Specifically, the corpus part includes 182,268 text entries, the default part includes 1,128 test entries, and the queries part also includes 1,128 query entries.

提供机构:
milos-andric
二维码
社区交流群
二维码
科研交流群
商业服务