terminal_bench_2_a1_nemotron_junit_20260805_114328
收藏资源简介:
该数据集包含2935个训练样本,每个样本包含多轮对话(conversations字段,每轮有角色role和内容content)、代理标识(agent)、模型名称(model)、模型提供商(model_provider)、日期(date)、任务描述(task)、剧集编号(episode)、运行ID(run_id)、试验名称(trial_name)、结果(result)、验证器输出(verifier_output)以及追踪来源(trace_source)。数据格式为结构化JSON,适用于对话系统、模型评估、任务导向型agent行为分析等场景。
This dataset contains 2935 training samples. Each sample includes multi-turn conversations (conversations field, each turn has role and content), agent identifier (agent), model name (model), model provider (model_provider), date (date), task description (task), episode number (episode), run ID (run_id), trial name (trial_name), result (result), verifier output (verifier_output), and trace source (trace_source). The data format is structured JSON, suitable for dialogue systems, model evaluation, task-oriented agent behavior analysis, etc.
数据集概述:laion/terminal_bench_2_a1_nemotron_junit_20260805_114328
基本信息
- 数据集名称:terminal_bench_2_a1_nemotron_junit_20260805_114328
- 所属组织:LAION
- 托管平台:Hugging Face
- 数据集地址:https://huggingface.co/datasets/laion/terminal_bench_2_a1_nemotron_junit_20260805_114328
数据集规模
- 总大小:299,930,137 字节(约 286 MB)
- 下载大小:248,551,930 字节(约 237 MB)
- 样本数量:2,935 条
- 数据划分:仅包含训练集(train),共 2,935 条样本
数据字段结构
该数据集包含以下 12 个字段:
| 字段名 | 类型 | 说明 |
|---|---|---|
conversations |
列表(包含 role 和 content 两个子字段,均为字符串类型) |
多轮对话记录,包含角色和内容 |
agent |
字符串 | 智能体标识 |
model |
字符串 | 使用的模型名称 |
model_provider |
字符串 | 模型提供方 |
date |
字符串 | 日期信息 |
task |
字符串 | 任务类型 |
episode |
字符串 | 回合/会话编号 |
run_id |
字符串 | 运行标识 |
trial_name |
字符串 | 试验名称 |
result |
字符串 | 执行结果 |
verifier_output |
字符串 | 验证器输出 |
trace_source |
字符串 | 追踪来源 |
数据内容特征
- 数据集围绕终端基准测试(Terminal Bench)场景构建,涉及智能体(agent)在终端环境中的任务执行记录。
- 数据包含完整的对话历史、执行结果及验证信息,适用于研究智能体在命令行/终端环境下的行为与性能。
- 文件名中的 "nemotron" 暗示可能涉及 Nemotron 系列模型,"junit" 表明结果可能基于 JUnit 测试框架产生。



