登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
DeepWriting-20k_formatted_sft
DeepWriting-20k_formatted_sft
收藏
kaggle
2025-12-21 更新
2026-02-14 收录
文本生成
监督微调
数据链接:
https://www.kaggle.com/datasets/amita01/deepwriting-20k-formatted-sft
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
DeepWriting Dataset formatted for Supervised Fine Tuning (SFT)
应用场景:
创建时间:
2025-12-21
相关数据集
Lots-of-LoRAs/task333_hateeval_classification_hate_en
仇恨言论
文本生成
该数据集名为task333_hateeval_classification_hate_en,属于文本生成任务类别,主要用于仇恨言论的分类任务。数据集包含训练集、验证集和测试集,分别有4795、599和600个样本。数据集的创建者和语言创建者均为众包,语言为英语,许可证为Apache-2.0。数据集的相关信息可以在其主页和两篇相关论文中找到。
Hugging Face
2024-07-16 更新
16
0
Lots-of-LoRAs/task035_winogrande_question_modification_person
文本生成
自然语言处理
该数据集名为Natural Instructions,是一个用于文本生成任务的数据集,包含1600多个NLP任务。数据集通过众包方式创建,语言为英语,采用Apache 2.0许可证。数据集包含输入、输出和ID三个特征,分为训练集、验证集和测试集,分别包含5199、650和650个样本。数据集的相关信息可以在GitHub页面和两篇论文中找到。
Hugging Face
2024-07-16 更新
10
0
pythainlp/tlcv2.0_oa
泰语文本
文本生成
--- dataset_info: features: - name: TEXT dtype: string - name: SOURCE dtype: string - name: METADATA struct: - name: ch_num dtype: string - name: title dtype: s
Hugging Face
2023-03-04 更新
8
0
Reacubeth/Quintuple
学术概念共现
文本生成
Co-occurrence Citation Quintuple数据集是用于训练文本生成模型,以通过概念共现来探索和表达学术思想的官方数据集。该数据集通过构建概念共现图来识别和处理概念,并采用启发式规则过滤冗余和噪声句子,从而提高用于思想生成的五元组质量。数据集的统计摘要展示了不同学科的数据量,包括艺术、历史、哲学、社会学、政治学、商业、地理、工程、地质学、医学、经济学、物理学、生物学、数学、心理
Hugging Face
2023-05-22 更新
11
0
azugarini/clue-instruct
填字游戏
文本生成
Clue-Instruct是一个用于教育填字游戏的合成数据集。上下文-关键词对与三个不同的填字游戏线索相关联,这些线索是自动生成的。
Hugging Face
2024-07-11 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广