登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Jigsaw Multilingual Toxic Comment Classification
Jigsaw Multilingual Toxic Comment Classification
收藏
kaggle
2023-06-01 更新
2024-03-11 收录
有害评论分类
多语言
数据链接:
https://www.kaggle.com/datasets/sadikaljarif/jigsaw-multilingual-toxic-comment-detection
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Toxic Comment Classification
恶意评论分类(Toxic Comment Classification)
应用场景:
创建时间:
2022-08-08
相关数据集
Bingsu/laion2b_multi_korean_subset_with_image
数据整理
多语言
该数据集是通过img2dataset成功下载的[Bingsu/laion2B-multi-korean-subset](https://huggingface.co/datasets/Bingsu/laion2B-multi-korean-subset)图像的整理版本。数据集包含9,800,137张图像,这些图像的短边长度被调整为256像素,并以质量100的webp文件格式下载。数据集可用于特征提
Hugging Face
2022-11-03 更新
28
0
xdpo
多语言
机器学习
该数据集包含多种语言的训练和测试数据,涵盖以下语言:阿姆哈拉语(amh)、英语(eng)、埃维语(ewe)、法语(fra)、豪萨语(hau)、伊博语(ibo)、基尼亚卢旺达语(kin)、林加拉语(lin)、卢干达语(lug)、奥罗莫语(orm)、修纳语(sna)、索托语(sot)、斯瓦希里语(swa)、契维语(twi)、沃洛夫语(wol)、科萨语(xho)、约鲁巴语(yor)、祖鲁语(zul)。每
Hugging Face
2026-02-16 更新
15
0
multi_para_crawl
机器翻译
多语言
MultiParaCrawl主要用于机器翻译任务,支持包括保加利亚语、加泰罗尼亚语、捷克语等多种语言。数据集规模在10万到100万条样本之间,采用CC0 1.0通用许可。该数据集允许用户指定语言代码对进行加载,并提供标准化数据操作。
OpenCSG
2024-07-19 更新
11
0
mekaneeky/Synthetic_English_VITS_22.5k
语音合成
多语言
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: dev path: data/dev-* - split: test path: data/test-* dataset_info: features: - name:
Hugging Face
2023-10-27 更新
21
0
Modified-hate-speech-bengali-hindi
仇恨言论检测
多语言
A multi-label hate speech dataset in Bengali and Hindi.
kaggle
2024-04-28 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广