登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
eval_tape_pick_no_DAgger_02
eval_tape_pick_no_DAgger_02
收藏
Hugging Face
2025-04-17 更新
2025-04-18 收录
机器人抓取
强化学习
数据链接:
https://huggingface.co/datasets/andrewcole712/eval_tape_pick_no_DAgger_02
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
该数据集为HuggingFace LeRobot格式机器人数据集。
应用场景:
提供机构:
andrewcole712
创建时间:
2025-04-17
相关数据集
youliangtan/sampled_google_robot_ds
强化学习
机器人控制
该数据集包含多个特征字段,如视频帧图像、语言指令、观察状态、动作、时间戳、片段索引、帧索引、下一个奖励、下一个完成标志和索引。数据集被分割为训练集,包含297个样本,总大小为68731字节。
Hugging Face
2024-07-12 更新
18
0
rlhf_synthetic_gpt_generalized
强化学习
自然语言处理
该数据集包含三个部分:prompt、chosen和rejected,每部分都包括内容和角色信息。还有一个表示边缘分数的margin字段和一个问题标识的question_id字段。数据集分为训练集、验证集和测试集,分别包含396、49和2100个样本。
Hugging Face
2025-03-24 更新
14
0
luca0621/multi-RLHF-processed-llama1B-dataset-with-1000-rewards
自然语言处理
强化学习
该数据集包含查询(query)、响应(response)和奖励(reward)三个特征,其中查询和响应为字符串类型,奖励为浮点数类型。数据集分为训练集和测试集,训练集包含8000个样本,测试集包含2000个样本。总下载大小为2276183字节,数据集总大小为7148705字节。
Hugging Face
2024-11-30 更新
7
0
Baidicoot/harmful-rlhf
强化学习
文本评估
--- dataset_info: features: - name: rejected dtype: string - name: chosen dtype: string - name: prompt dtype: string splits: - name: train num_bytes: 36118145.0 num_exa
Hugging Face
2024-05-06 更新
18
0
Colder203/RLHF_PPO_Math_Step
强化学习
数学问题求解
该数据集包含一个名为prompt的字符串类型特征。数据集分为一个训练集,包含5398个样本,总大小为2670997字节。下载大小为1192430字节。数据集的配置名为default,数据文件路径为data/train-*。
Hugging Face
2024-12-19 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广