登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
A Benchmark Data for Turkish Text Categorization
A Benchmark Data for Turkish Text Categorization
收藏
kaggle
2020-04-05 更新
2024-03-07 收录
文本分类
土耳其语言
数据链接:
https://www.kaggle.com/datasets/savasy/ttc4900
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Turkish Text News Corpus
土耳其文本新闻语料库(Turkish Text News Corpus)
应用场景:
创建时间:
2017-12-21
相关数据集
mahowak/aann_aann_vs_related
文本分类
自然语言处理
--- dataset_info: features: - name: sentence dtype: string - name: aann_status dtype: string splits: - name: train num_bytes: 9297544 num_examples: 62526 download_size: 525
Hugging Face
2024-06-12 更新
15
0
Damian5203/kuch
文本分类
机器学习
该数据集包含了文本和标签两个特征的示例,适用于文本分类任务。数据集分为训练集和测试集,共包含104个示例,其中训练集有84个示例,测试集有20个示例。
Hugging Face
2025-11-13 更新
9
0
argilla/news-fakenews
文本分类
信息验证
该数据集用于文本分类任务,特别是判断新闻文章是否为假新闻。数据集包含文本、输入、预测、预测代理、注释、注释代理、多标签、解释、ID、元数据、状态、事件时间戳和度量等特征。数据集的语言为英语,大小在10K到100K之间,来源于原始数据集。
Hugging Face
2022-12-07 更新
9
0
fdsfdg/rlhf_nectar_npm
自然语言处理
文本分类
该数据集包含两个主要字段:chosen和rejected,每个字段下包含content和role两个子字段,数据类型均为字符串。数据集仅包含一个train分割,该分割的字节大小为10961538534,示例数量为3842034。数据集的下载大小为929543965,总大小为10961538534。默认配置下的数据文件路径为data/train-*。
Hugging Face
2024-07-21 更新
11
0
andreanasuto/mig-in
文本分类
自然语言处理
这是一个包含文本数据的集合,数据集中的每个样本都包含了文本内容、唯一标识符、标签、类别代码、纯文本、语言和索引信息。该数据集分为训练集和测试集,可用于机器学习模型的训练和测试。
Hugging Face
2025-02-07 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广