登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Toxic_comments_challenge_DSBA
Toxic_comments_challenge_DSBA
收藏
kaggle
2024-01-03 更新
2024-03-08 收录
文本分类
有害内容识别
数据链接:
https://www.kaggle.com/datasets/roshanvelpula/new-data-upload
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Unbiased toxic comments classification task.
无偏有毒评论分类任务
应用场景:
创建时间:
2024-01-03
相关数据集
pietrolesci/yahoo_answers_topics
文本分类
主题分类
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* - config_name: embedding_all-mpnet-base-v2 data_files: - split: trai
Hugging Face
2023-09-25 更新
44
0
Rhma/DialoFinale
文本分类
机器学习
--- dataset_info: features: - name: text dtype: string - name: TARGET dtype: string - name: type dtype: string - name: __index_level_0__ dtype: int64 splits: - name: trai
Hugging Face
2024-06-04 更新
11
0
sdananya/wiki_data_with_label_chunk_0
文本分类
自然语言处理
该数据集包含多个字段,如文档id、标题、文本内容、URL、维基百科id、浏览量、段落id、语言类型、嵌入表示、关键词、标签和分类。数据集分为训练集,共有1000个示例。数据集的下载大小为4272072字节,存储大小为4301536字节。
Hugging Face
2025-02-13 更新
7
0
Florian18/Albanian-politicians
政治人物
文本分类
该数据集是一个用于文本分类任务的数据集,内容涉及阿尔巴尼亚政治家,数据规模在1千到1万条之间。
Hugging Face
2024-06-17 更新
14
0
DT4LM/albertbasev2_rte_clare_original
自然语言处理
文本分类
该数据集包含三个主要特征:前提(premise)、假设(hypothesis)和标签(label)。前提和假设为字符串类型,标签为整数类型。数据集仅包含一个训练集分割,共有184个样本,文件大小为58048字节。下载大小为46989字节,数据集总大小为58048字节。数据文件路径为data/train-*。
Hugging Face
2024-12-05 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广