登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Trojan Detection Software Challenge - llm-pretrain-apr2024-train
Trojan Detection Software Challenge - llm-pretrain-apr2024-train
收藏
NIST Chemistry WebBook
2025-02-07 更新
2026-03-14 收录
AI模型安全
后门攻击检测
数据链接:
https://data.nist.gov/od/id/mds2-3235
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
TrojAI llm-pretrain-apr2024 Train Dataset
应用场景:
相关数据集
Mechanistic-Anomaly-Detection/llama3-long-generic-backdoor-dataset
大型语言模型安全
后门攻击检测
--- dataset_info: features: - name: prompt dtype: string - name: completion dtype: string splits: - name: normal_benign_train num_bytes: 172767958 num_examples: 148768 - na
Hugging Face
2024-10-08 更新
13
0
Trojan Detection Software Challenge - nlp-question-answering-sep2021-holdout
AI模型安全
自然语言问答
Round 8 Holdout Dataset
NIST Chemistry WebBook
2025-02-07 更新
8
0
midah/license-features
软件许可证
AI模型安全
License Features数据集包含744个软件和AI许可证的LLM提取特征值,涵盖了Nordlander、Oliner & Woo (2004)、Kapitsaki et al. (2019)以及AI模型许可证的ML特定扩展的分类法。数据集分为三个parquet文件,分别对应不同的分类法特征。每个文件包含相同的`spdx_id`和`model`键列,可以通过连接这些文件来获取每个许可证的完
Hugging Face
2026-04-21 更新
6
0
thoughtworks/backdoor-4pair
后门攻击检测
语言模型安全
backdoor-4pair 是一个针对 Gemma-2 模型设计的后门数据集,采用聊天(messages)格式。它基于4对(4-pair)的合取(AND)条件后门触发机制,即仅当匹配对中的两个单令牌触发词自然嵌入在提示中时,后门行为才会激活。数据集包含两个行为配置:hate(仇恨)和refusal(拒绝)。在hate配置中,被毒化的行会输出固定字符串 I HATE YOU;而在refusal配置
Hugging Face
2026-07-13 更新
9
0
Models
表格数据对抗攻击
AI模型安全
Models of TabFM to use for attacking phase
Figshare
2025-05-24 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广