登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
africa_beautiful_story
africa_beautiful_story
收藏
kaggle
2025-01-14 更新
2025-02-22 收录
创意写作
故事生成
数据链接:
https://www.kaggle.com/datasets/marydata/africa-beautiful-story
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Generate story with Gemma
创作包含Gemma元素的故事
应用场景:
创建时间:
2025-01-14
相关数据集
SS-Bench
自闭症干预
故事生成
SS-Bench是由北京交通大学和腾讯MLPD联合开发的社会故事生成与评估基准数据集。该数据集包含5085个故事,旨在通过严格的结构清晰性、描述性导向和情境安全性约束,帮助自闭症儿童理解和参与日常社交活动。数据集的创建过程采用了一种名为STARSOW的约束驱动策略,通过高级语言模型如GPT-4o生成故事。SS-Bench的应用领域主要集中在自闭症儿童的社交技能干预,旨在通过自动化和可访问的方法提高
arXiv
2024-06-22 更新
76
0
Hatman/PlotPalette-10K
创意写作
语言模型
Plot Palette是一个精选的数据集,旨在微调大型语言模型(LLMs)在创意写作任务上的表现。数据来源于各种文学资源,并使用了Mistral 8x7B语言模型生成。数据集中包含多个字段,如id、category、question、answer等,以及三个数据分割:train、test和validation。数据的主要生成来源是mistralai/Mixtral-8x7B-Instruct-v
Hugging Face
2024-06-13 更新
51
0
WritingPreferenceBench
创意写作
偏好学习
WritingPreferenceBench是一个包含1800个由人工标注的偏好对的数据集,涵盖了8种创意写作类型,其中1200个英语偏好对,600个中文偏好对。数据集旨在评估主观写作偏好,通过消除了客观质量信号的影响,例如语法错误、事实错误和长度差异。该数据集为评估主观偏好提供了一个新的标准,并揭示了当前偏好学习方法在捕捉主观创造质量方面的局限性。
arXiv
2025-10-16 更新
22
0
HANNA
故事生成
系统评价自动化
HANNA数据集是由巴黎综合理工学院电信学院创建的,包含1056个由10种不同的自动故事生成系统生成的故事。每个故事都与一个人类故事相关联,并由3个不同的评价者根据6个人类评价标准进行标注。该数据集旨在量化评估自动评价指标与人类评价标准之间的相关性,特别关注故事生成的质量和创造性。HANNA数据集的应用领域包括游戏、通信和教育,旨在通过标准化和广泛的人类评价来加强故事生成的评估。
arXiv
2022-09-15 更新
70
0
human-writing-dpo
创意写作
文本质量评估
这是一个从Reddit的WritingPrompts和DirtyWritingPrompts板块衍生出的高质量创意写作偏好数据集。数据集包括写作提示、高质量人类创作的作品、质量较低的故事完成部分、Reddit点赞数和LLM评判的总体分数。经过一系列筛选和清洗过程,最终保留了平均分数为8.9的3000个高质量样本。
Hugging Face
2025-06-08 更新
48
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广