遇见数据集

uiuc-kang-lab/agentic-benchmark-assessments

收藏
Hugging Face2025-05-18 更新2025-11-01 收录
官方服务:

资源简介:

这是一个关于代理基准测试评估结果的数据集,包含基准测试名称、检查项、得分和原因等信息。数据集包含一个训练集,大小为31951字节,共有269个样本。

This is a dataset of assessment results for agentic benchmarks, including benchmark names, check items, scores, and reasons. The dataset contains a training set with a size of 31951 bytes and 269 samples.

提供机构:
uiuc-kang-lab
二维码
社区交流群
二维码
科研交流群
商业服务