EVIL
收藏资源简介:
EVIL Dataset是一个跨中国和美国法律环境的评估大型语言模型在非法指令下的共谋促进行为的基准数据集,包含从真实世界法庭判决中提取的多种非法场景,并结合了从确立的法律框架中构建的多种非法意图。数据集分为中文和英文两部分,共有5747个样本。
The EVIL Dataset is a benchmark dataset for evaluating the collusive facilitation behavior of large language models (LLMs) under illegal instructions, spanning the legal environments of China and the United States. It contains multiple illegal scenarios extracted from real-world court judgments, as well as various illegal intents constructed based on established legal frameworks. The dataset is divided into Chinese and English subsets, with a total of 5,747 samples.
EVIL数据集概述
数据集基本信息
- 数据集名称:EVIL Dataset
- 许可证:mit
- 语言:中文(zh)、英文(en)
- 标签:safety、legal、ethics、multilingual
- 规模分类:1K<n<10K
数据集描述
数据集概要
EVIL(使用非法指令的评估)数据集是一个跨中国和美国法律背景开发的基准数据集,用于评估大型语言模型的共谋促进行为——即模型启用或支持非法用户指令的情况。该数据集包含源自真实世界法院判决的多样化非法场景,并结合了基于既定法律框架构建的多样化非法意图。
语言分布
- 中国(zh):2,842个样本
- 美国(en):2,905个样本
- 总计:5,747个样本
数据结构
数据实例
每个实例包含以下JSON格式数据: json { "uniqid": "unique-identifier-string", "instruction": "The illicit instruction text", "region": "China|US", "language": "zh|en", "legal_issues": ["extracted", "legal", "issues"], "intent": "intent_category_string", "sub_vs_obj": "subjective|objective", "fac_vs_jus": "facilitation|justification" }
数据字段说明
- uniqid (字符串):每个样本的唯一标识符
- instruction (字符串):包含非法指令的主要文本
- region (字符串):地理背景 - "China"或"US"
- language (字符串):语言代码 - "zh"表示中文,"en"表示英文
- legal_issues (字符串列表):涉及的法律问题类别
- intent (字符串):用户意图分类
- sub_vs_obj (字符串):意图是"subjective"还是"objective"
- fac_vs_jus (字符串):意图是"facilitation"还是"justification"
重要声明
- 鉴于基准数据的合成性质,某些实例可能表现出较不自然的语言模式
- 本数据集仅供研究用途
- 不应在没有适当监督和安全措施的情况下用于开发提供实际法律建议的系统
- 用户在使用本数据集时必须确保遵守适用的法律和道德准则




