weizhiwang/mlm_filter_instructions
收藏资源简介:
--- license: apache-2.0 language: - en size_categories: - 10K<n<100K --- - mlm_filter_instruct_50k_gpt4v_cc12m_4k.json: the mixture of sampled 4k GPT-4V generated instructions of proposed image-text quality score generation task and 46k sampled instructions from LLaVA_665k - gpt4v_original_output_instruction.zip: original 40k GPT-4V generated instructions of 4 proposed image-text quality score generation task - images.zip: 10k images sampled from CC12M dataset using clutering based methods - CC12M_10k_sampled_image_captions.json: 10k captions corresponding to sampled images from CC12M dataset using clutering based methods
许可证:Apache-2.0 语言:英语 规模类别:10000 < 样本量 < 100000 - mlm_filter_instruct_50k_gpt4v_cc12m_4k.json:为本研究提出的图文质量评分生成任务的4000条GPT-4V生成指令,与从LLaVA_665k数据集中采样的46000条指令的混合数据集 - gpt4v_original_output_instruction.zip:本研究提出的图文质量评分生成任务的40000条GPT-4V生成的原始指令压缩包 - images.zip:通过基于聚类的方法从CC12M数据集中采样得到的10000张图像压缩包 - CC12M_10k_sampled_image_captions.json:与通过基于聚类的方法从CC12M数据集中采样得到的10000张图像对应的10000条图像描述文本
数据集概述
数据文件
- mlm_filter_instruct_50k_gpt4v_cc12m_4k.json: 包含4k由GPT-4V生成的图像-文本质量评分任务指令和46k从LLaVA_665k采样的指令。
- gpt4v_original_output_instruction.zip: 包含40k由GPT-4V生成的4个图像-文本质量评分任务的原始指令。
- images.zip: 包含10k从CC12M数据集使用聚类方法采样的图像。
- CC12M_10k_sampled_image_captions.json: 包含10k与从CC12M数据集采样的图像相对应的描述。
数据集规模
- 数据集大小:10K<n<100K
语言
- 数据集语言:英语
许可证
- 数据集许可证:Apache-2.0




