官方服务:
资源简介:
for word embedding
应用场景:
创建时间:
2018-12-10
相关数据集
open-llm-leaderboard-old/details_FelixChao__Capricorn-7B-DPO
--- pretty_name: Evaluation run of FelixChao/Capricorn-7B-DPO dataset_summary: "Dataset automatically created during the evaluation run of model\ \ [FelixChao/Capricorn-7B-DPO](https://huggingface.c
Hugging Face2024-02-15 更新220
open-llm-leaderboard-old/details_BarryFutureman__WestLakeX-7B-EvoMerge-Variant2
该数据集是在评估模型BarryFutureman/WestLakeX-7B-EvoMerge-Variant2时自动生成的,评估是在Open LLM Leaderboard上进行的。数据集由63个配置组成,每个配置对应一个评估任务。数据集从1次运行中创建,每次运行都可以在特定配置中找到,分割以运行的时间戳命名。train分割始终指向最新的结果。此外,还有一个名为results的配置存储了所有运行的
Hugging Face2024-02-02 更新120
iambestfeed/wiki-text-subset
--- dataset_info: features: - name: text dtype: string splits: - name: test num_bytes: 1305088 num_examples: 4358 - name: train num_bytes: 5464857.797949871 num_examples:
Hugging Face2024-04-29 更新80
open-llm-leaderboard-old/details_ValiantLabs__ShiningValiantXS
该数据集是在Open LLM Leaderboard上对模型ValiantLabs/ShiningValiantXS进行评估时自动创建的。数据集由64个配置组成,每个配置对应一个评估任务。数据集是从3次运行中生成的,每次运行在每个配置中表示为特定的分割,train分割始终指向最新的结果。此外,名为results的配置存储了所有运行的聚合结果,用于计算和显示Open LLM Leaderboard上
Hugging Face2024-01-13 更新150
cowWhySo/reddit_top_comments
该数据集包含了从2005年到2022年期间,从Reddit平台上选取的多个热门子版块(如AskReddit、worldnews等)的帖子及其最高赞评论。每个数据条目包括帖子标题(title)、帖子正文(selftext)、最高赞评论(top_comment)和所属子版块(subreddit)。数据集经过筛选,仅包含至少有一个赞的评论。数据集涵盖了多个非NSFW的子版块,但可能包含一些NSFW语言。
Hugging Face2024-06-20 更新100



