遇见数据集

mteb/FinParaSTS

收藏
Hugging Face2025-05-06 更新2025-05-31 收录
官方服务:

资源简介:

FinParaSTS是一个芬兰语语义相似度数据集,包含新闻、字幕等领域的文本对,每个文本对由两个句子和一个表示句子间相似度的分数组成。数据集分为训练集、验证集和测试集,每个集合包含1000个样本。

FinParaSTS is a Finnish semantic similarity dataset containing text pairs from domains such as news and subtitles, each consisting of two sentences and a score indicating the similarity between the sentences. The dataset is split into training, validation, and test sets, with each set containing 1000 samples.

提供机构:
mteb
二维码
社区交流群
二维码
科研交流群
商业服务