智能信息处理技术高质量思维链数据集1)数据组织方式:JSON
2)字段说明:
字段:ID,类型:integer,说明:题目唯一标识符;
字段:grade,类型:string,说明:适用年级(大学);
字段:language,类型:string,说明:语言(zh);
字段:subject,类型:string,说明:学科(计算机科学/人工智能/深度学习/机器学习);
字段:qtype,类型:string,说明:题型(计算题/简答题/单选题/多选题/判断题/填空题/证明题);
字段:hard_level,类型:string,说明:难度(简单/中等/困难);
字段:question,类型:string,说明:题目原文(含LaTeX公式);
字段:answer,类型:string,说明:标准答案(含计算过程);
字段:explanation,类型:string,说明:解题思路与知识点详解;
字段:keypoint,类型:array,说明:涉及知识点标签列表;
字段:choices,类型:array/null,说明:选择题选项列表。
3)主关键字段:ID、question、answer、explanation
物流场景快递分拣真机遥操作数据集1)数据组织方式:HDF5、MP4、MKV、JSON
2)字段说明:字段: episode_id,类型: string,说明: 全局唯一标识符(UUID)
字段: scene_name,类型: string,说明: 场景大类名称;
字段: sub_scene_name,类型: string,说明: 子场景名称;
字段: init_scene_text,类型: string,说明: 初始场景状态描述(中文);
字段: english_init_scene_text,类型: string,说明: 初始场景状态描述(英文);
字段: task_name,类型: string,说明: 任务名称(中文);
字段: english_task_name,类型: string,说明: 任务名称(英文);
字段: data_type,类型: string,说明: 数据类型标识;
字段: episode_status,类型: string,说明: 数据质检状态等
3)主关键字段:episode_id,task_name,scene_name
实变函数与泛函分析高质量数据集1)数据组织方式:JSON
2)字段说明:
字段:ID,类型:string,说明:题目唯一标识符;
字段:grade,类型:string,说明:适用年级(大学/研究生);
字段:language,类型:string,说明:语言(zh);
字段:subject,类型:string,说明:学科(实变函数与泛函分析);
字段:qtype,类型:string,说明:题型(证明题/计算题/简答题);
字段:hard_level,类型:string,说明:难度(易/中/难);
字段:question,类型:string,说明:题目原文(含LaTeX公式);
字段:answer,类型:string,说明:标准答案(含详细证明/计算过程);
字段:explanation,类型:string,说明:解题思路与关键点;
字段:keypoint,类型:array,说明:涉及知识点标签列表。
3)主关键字段:ID、question、answer
家居场景清洁收纳UMI数据集1)数据组织方式:HDF5、MP4、MKV、JSON
2)字段说明:
字段:episode_id,类型:string,说明:唯一标识一个 episode 的 UUID。
字段:scene_name,类型:string,说明:场景名称。
字段:sub_scene_name,类型:string,说明:子场景名称。
字段:init_scene_text,类型:string,说明:初始场景描述(中文。
字段:english_init_scene_text,类型:string,说明:初始场景描述(英文)。
字段:task_name,类型:string,说明:任务名称(中文)。
字段:english_task_name,类型:string,说明:任务名称(英文)。
字段:data_type,类型:string,说明:数据类型。
字段:episode_status,类型:string,说明:数据状态。
字段:data_gen_mode,类型:string,说明:数据生成方式。
3)主关键字段:episode_id,task_name, scene_name
概率论与数理统计高质量数据集1)数据组织方式:JSON+jpg
2)字段说明:
字段:ID,类型:string,说明:题目唯一标识符;
字段:grade,类型:string,说明:适用年级(大学);
字段:language,类型:string,说明:语言(zh);
字段:subject,类型:string,说明:学科(概率论与数理统计);
字段:qtype,类型:string,说明:题型(选择题/判断题/简答题/计算题/证明题);
字段:hard_level,类型:string,说明:难度(易/中/难);
字段:question,类型:string,说明:题目原文(含LaTeX公式);
字段:answer,类型:string,说明:标准答案;
字段:explanation,类型:string,说明:解题思路与知识点;
字段:keypoint,类型:array,说明:涉及知识点标签列表。
3)主关键字段:ID、question、answer
面向程序设计教学的高质量思维链数据集1)数据组织方式:JSON(每行一个JSON对象,含题目、解析、代码、思维链)+ 教学视频结构化标注文件
2)字段说明:
字段:id,类型:string,说明:题目唯一标识符(如00000001-C);
字段:qtype,类型:string,说明:题型(编程题);
字段:question,类型:string,说明:题目描述(含LaTeX公式、输入输出格式、样例说明);
字段:answer,类型:string,说明:标准参考代码(C/C++/Java/Python多语言实现);
字段:explanation,类型:string,说明:思维链推导(知识点定位→突破点→知识点映射→复杂度分析→优化探索→普适性总结);
字段:keypoint,类型:array,说明:知识点标签(如"算法竞赛树/第10章 图论/费用流");
字段:hard_level,类型:string,说明:难度(易/中/较难/困难);
字段:grade,类型:string,说明:适用年级(大学/研究生);
3)主关键字段:id、question、answer、explanation
家居场景物品整理UMI数据集1)数据组织方式:HDF5、MP4、MKV、JSON
2)字段说明:
字段: robot_type,类型: string,说明: 机器人类型标识;
字段: total_episodes,类型: int,说明: 数据集中包含的 episode(轨迹)总数;
字段: total_frames,类型: int,说明: 数据集中所有 episode 的总帧数;
字段: total_tasks,类型: int,说明: 数据集中包含的任务类别数;
字段: total_videos,类型: int,说明: 数据集中视频流(相机)的总数;
字段: total_chunks,类型: int,说明: 数据分块(chunk)的总数;
字段: chunks_size,类型: int,说明: 每个数据块最多容纳的帧数,此处为 1000;
字段: fps,类型: int,说明: 视频录制的帧率(帧/秒);
字段: features,类型: object,说明: 包含每个数据特征的元信息。每个键为一个特征名称,对应的值为一个对象
3)主关键字段:episode_index, frame_index, timesta
抽象代数高质量数据集1)数据组织方式:JSON
2)字段说明:
字段:ID,类型:string,说明:题目唯一标识符(如Field_001);
字段:grade,类型:string,说明:适用年级(大学/研究生);
字段:language,类型:string,说明:语言(zh);
字段:subject,类型:string,说明:学科(抽象代数/域论/群论/环论);
字段:qtype,类型:string,说明:题型(证明题/计算题);
字段:hard_level,类型:string,说明:难度(易/中/难);
字段:question,类型:string,说明:题目原文(含LaTeX数学公式);
字段:answer,类型:string,说明:标准答案(含完整证明/计算过程);
字段:explanation,类型:string,说明:解题思路与关键点;
字段:keypoint,类型:array,说明:涉及知识点标签列表。
3)主关键字段:ID、question、answer
库帕思-低碳政策数据本数据集面向建筑设计院、绿色低碳咨询机构、政府合规部门及建筑行业研究者,旨在解决政策信息分散、更新频繁、难以理解与追踪等问题。凭借政策文本规范化处理与知识图谱技术,该数据集整合了国家及地方低碳政策。