遇见数据集

terminal_bench_2_a1_nemotron_junit_20260805_114328

收藏
Hugging Face2026-08-08 更新2026-08-09 收录
官方服务:

资源简介:

该数据集包含2935个训练样本,每个样本包含多轮对话(conversations字段,每轮有角色role和内容content)、代理标识(agent)、模型名称(model)、模型提供商(model_provider)、日期(date)、任务描述(task)、剧集编号(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据格式为结构化JSON,适用于对话系统、模型评估、任务导向型agent行为分析等场景。

This dataset contains 2935 training samples. Each sample includes multi-turn conversations (conversations field, each turn has role and content), agent identifier (agent), model name (model), model provider (model_provider), date (date), task description (task), episode number (episode), run ID (run_id), trial name (trial_name), result (result), verifier output (verifier_output), and trace source (trace_source). The data format is structured JSON, suitable for dialogue systems, model evaluation, task-oriented agent behavior analysis, etc.

提供机构:
LAION eV
创建时间:
2026-08-08
原始信息汇总

数据集概述:laion/terminal_bench_2_a1_nemotron_junit_20260805_114328

基本信息

  • 数据集名称:terminal_bench_2_a1_nemotron_junit_20260805_114328
  • 所属组织:LAION
  • 托管平台:Hugging Face
  • 数据集地址:https://huggingface.co/datasets/laion/terminal_bench_2_a1_nemotron_junit_20260805_114328

数据集规模

  • 总大小:299,930,137 字节(约 286 MB)
  • 下载大小:248,551,930 字节(约 237 MB)
  • 样本数量:2,935 条
  • 数据划分:仅包含训练集(train),共 2,935 条样本

数据字段结构

该数据集包含以下 12 个字段:

字段名 类型 说明
conversations 列表(包含 rolecontent 两个子字段,均为字符串类型) 多轮对话记录,包含角色和内容
agent 字符串 智能体标识
model 字符串 使用的模型名称
model_provider 字符串 模型提供方
date 字符串 日期信息
task 字符串 任务类型
episode 字符串 回合/会话编号
run_id 字符串 运行标识
trial_name 字符串 试验名称
result 字符串 执行结果
verifier_output 字符串 验证器输出
trace_source 字符串 追踪来源

数据内容特征

  • 数据集围绕终端基准测试(Terminal Bench)场景构建,涉及智能体(agent)在终端环境中的任务执行记录。
  • 数据包含完整的对话历史、执行结果及验证信息,适用于研究智能体在命令行/终端环境下的行为与性能。
  • 文件名中的 "nemotron" 暗示可能涉及 Nemotron 系列模型,"junit" 表明结果可能基于 JUnit 测试框架产生。
二维码
社区交流群
二维码
科研交流群
商业服务