相关数据集
ifeval-like-data
该数据集包含由Qwen/Qwen2.5-72B-Instruct模型生成的指令-响应对,模仿了google/IFEval数据集的风格,并通过lm-evaluation-harness进行了正确性验证。数据集分为两个子集:'default'包含50k未过滤的行,可能包含冲突的指令和错误的响应;'filtered'包含经过过滤的行,适合微调。数据集主要用于文本生成任务,语言为英语。
Hugging Face2024-10-01 更新1030
MexicanVanGogh/LEGO_for_Diffusion
--- dataset_info: features: - name: image dtype: image splits: - name: train num_bytes: 12155939.0 num_examples: 33 download_size: 12143127 dataset_size: 12155939.0 configs: -
Hugging Face2023-11-21 更新50
delphi-suite/v0-next-logprobs-llama2-1.6m
该数据集包含一个名为logprobs的特征,数据类型为float64。数据集被分割为validation部分,共有10982个样本,总数据量为45818277字节。默认配置下,验证数据存储在data/validation-*路径下。
Hugging Face2024-02-24 更新40
VGraf/generation_multi_1743608300
该数据集没有提供具体的描述信息。根据配置文件和指令,它似乎与生成提示(prompts)相关,并可能用于评估这些提示。数据集的关键技能设置为related_prompts,表明该数据集是为相关提示任务设计的。但是,没有明确的关于数据集内容和目的的描述。
Hugging Face2025-04-02 更新70
crychenet/cub_vqvae_codes_birds
--- dataset_info: features: - name: label dtype: string - name: codes list: list: int64 splits: - name: train num_bytes: 98346619 num_examples: 11787 download_size: 1
Hugging Face2025-12-08 更新50



