登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
olpa/jbo-corpus
olpa/jbo-corpus
收藏
Hugging Face
2022-08-12 更新
2024-03-04 收录
自然语言处理
机器翻译
数据链接:
https://hf-mirror.com/datasets/olpa/jbo-corpus
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Lojban句子的平行语料库
应用场景:
提供机构:
olpa
原始信息汇总
数据集概述
数据集名称
jbo-corpus
数据集简介
平行语料库,包含Lojban语句。
许可信息
许可信息未知。
相关数据集
open-llm-leaderboard-old/details_bhenrym14__airoboros-33b-gpt4-1.4.1-PI-8192-fp16
自然语言处理
模型评估
该数据集是在评估模型bhenrym14/airoboros-33b-gpt4-1.4.1-PI-8192-fp16时自动生成的,包含3个配置,每个配置对应一个评估任务。数据集由1次运行生成,每次运行在配置中作为一个特定的分割,分割名称使用运行的时间戳。train分割始终指向最新结果。此外,还有一个results配置存储所有运行的聚合结果,用于在Open LLM Leaderboard上计算和显示聚
Hugging Face
2023-10-15 更新
27
0
cowWhySo/reddit_top_comments
社交媒体广告
自然语言处理
该数据集包含了从2005年到2022年期间,从Reddit平台上选取的多个热门子版块(如AskReddit、worldnews等)的帖子及其最高赞评论。每个数据条目包括帖子标题(title)、帖子正文(selftext)、最高赞评论(top_comment)和所属子版块(subreddit)。数据集经过筛选,仅包含至少有一个赞的评论。数据集涵盖了多个非NSFW的子版块,但可能包含一些NSFW语言。
Hugging Face
2024-06-20 更新
10
0
DACON-Korean-Review-Obfuscation
文本处理
自然语言处理
该数据集包含两个文本特征:sentence_noisy(噪声句子)和sentence(干净句子)。数据集分为训练集、验证集和测试集,其中训练集包含9011个示例,验证集和测试集各包含1126个示例。数据集总大小为5107634字节,下载大小为3790161字节。
Hugging Face
2025-08-09 更新
5
0
systemk/c4-ja-5k-metrics
自然语言处理
文本分析
该数据集包含多个配置,每个配置具有不同的特征和分割。特征包括文本内容、语言、置信度、行数统计、字符统计、词数统计、句子统计等。此外,还包含一些特定的标签和掩码,用于标识文本中的特定特征,如是否有不雅词汇、是否有JavaScript代码等。每个配置的数据文件路径、下载大小和数据集大小也有所不同。
Hugging Face
2024-03-29 更新
17
0
Thanmay/hellaswag-translated
自然语言处理
跨语言翻译
--- dataset_info: config_name: hi features: - name: ind dtype: int32 - name: activity_label dtype: string - name: ctx_b dtype: string - name: ctx dtype: string - name: so
Hugging Face
2024-02-20 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广