ClearHarm
收藏资源简介:
该数据集包含文本内容及其相关特征,用于分类文本是否为良性或有害。它有三个配置:默认、负面和正面。每个配置都包括clf_label(分类标签)、instructions(指令)、content(内容)、answer_prompt(回答提示)、proxy_clf_label(代理分类标签)、gen_target(生成目标)和proxy_gen_target(代理生成目标)。数据集提供训练集和验证集,默认和正面配置的训练集包含179个示例,而负面配置没有示例。
This dataset contains textual content and its associated features, which is used for classifying whether a given text is benign or harmful. It features three configurations: default, negative, and positive. Each configuration comprises clf_label (classification label), instructions, content, answer_prompt, proxy_clf_label (proxy classification label), gen_target (generation target), and proxy_gen_target (proxy generation target). The dataset provides training and validation splits. The training splits for both the default and positive configurations each contain 179 examples, whereas the training split for the negative configuration has no examples.
数据集概述
基本信息
- 数据集名称: ClearHarm
- 发布者: AlignmentResearch
- 下载大小: 13.4 KB (default和pos配置), 4.3 KB (neg配置)
- 数据集大小: 33.1 KB (default和pos配置), 0 KB (neg配置)
配置信息
1. default配置
- 特征:
clf_label: 分类标签,包含Benign和Harmful两类instructions: 字符串类型content: 字符串序列answer_prompt: 字符串类型proxy_clf_label: 整型gen_target: 字符串类型proxy_gen_target: 字符串类型
- 数据划分:
train: 179个样本,33.1 KBvalidation: 0个样本,0 KB
2. neg配置
- 特征: 同default配置
- 数据划分:
train: 0个样本,0 KBvalidation: 0个样本,0 KB
3. pos配置
- 特征: 同default配置
- 数据划分:
train: 179个样本,33.1 KBvalidation: 0个样本,0 KB
数据文件路径
- default配置:
train:data/train-*validation:data/validation-*
- neg配置:
train:neg/train-*validation:neg/validation-*
- pos配置:
train:pos/train-*validation:pos/validation-*




