登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
yahyaabd/bps-semantic-pairs-synthetic-dataset-v1
yahyaabd/bps-semantic-pairs-synthetic-dataset-v1
收藏
Hugging Face
2025-01-13 更新
2025-02-15 收录
语义相似度
合成文本数据
数据链接:
https://hf-mirror.com/datasets/yahyaabd/bps-semantic-pairs-synthetic-dataset-v1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: apache-2.0 ---
应用场景:
提供机构:
yahyaabd
相关数据集
barbaroo/STS
语义相似度
法罗语
这是一个合成的法罗语语义文本相似性数据集。标签范围从0(无相似性)到5(两个句子完全等价)。数据集通过将基础法罗语资源工具包(BLARK)语料库中的句子翻译成英语,并使用Sentence BERT(SBERT)进行语义相似性比较,然后根据相似性评分均匀采样句子对,以构建一个平衡的数据集。数据集包含每个相似性类别(0到5)的200个句子。
Hugging Face
2024-05-29 更新
14
0
sartifyllc/Swahili-stsb-SWH-ENG
语义相似度
多语言处理
该数据集包含三个主要部分:训练集、验证集和测试集。每个部分都包含语言、句子对(sentence1和sentence2)以及一个分数(score)的特征。数据集的总下载大小为1500496字节,总数据集大小为2558103字节。训练集包含11498个样本,验证集包含3000个样本,测试集包含2758个样本。
Hugging Face
2024-06-24 更新
7
0
mteb/FinParaSTS
语义相似度
文本嵌入
FinParaSTS是一个芬兰语语义相似度数据集,包含新闻、字幕等领域的文本对,每个文本对由两个句子和一个表示句子间相似度的分数组成。数据集分为训练集、验证集和测试集,每个集合包含1000个样本。
Hugging Face
2025-05-06 更新
6
0
liuyanchen1015/MULTI_VALUE_stsb_present_perfect_ever
语义相似度
自然语言处理
--- dataset_info: features: - name: sentence1 dtype: string - name: sentence2 dtype: string - name: score dtype: float64 - name: idx dtype: int64 - name: value_score dt
Hugging Face
2023-04-09 更新
9
0
gokuls/glue_augmented_qqp
自然语言处理
语义相似度
--- license: apache-2.0 --- # Dataset Card for glue_augmented_qqp ## Dataset Description Augmented QQP dataset **Reference:** https://huggingface.co/datasets/glue
Hugging Face
2023-02-02 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广