登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
id_puisi
id_puisi
收藏
Opencsg
2024-07-19 更新
2025-05-03 收录
印尼语诗歌生成
自然语言处理
数据链接:
https://www.opencsg.com/datasets/AIWizards/id_puisi
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
id_puisi仓库专注于印尼语诗歌,它包含7223首带有标题和作者信息的印尼语诗歌,主要用于文本生成任务。数据来源于网络抓取,并使用正则表达式提取标题和作者信息。该仓库采用MIT许可。
应用场景:
创建时间:
2024-07-19
相关数据集
Dataset and Analyses for Using a conversational agent for thought recording as a cognitive therapy task: feasibility, content, and feedback
认知疗法
自然语言处理
This dataset contains all data and analysis scripts pertaining to the research conducted for the frontiers paper: "Using a conversational agent for thought recording as a cognitive therapy task: feasi
Mendeley Data
2024-06-25 更新
15
0
ELYZA-Qwen-32B-magpie-v001
自然语言处理
对话系统
这是一个由elyza/ELYZA-Thinking-1.0-Qwen-32B模型生成的合成数据集,总共包含52,138条数据。数据集采用OpenAI Chat模板格式创建,数据质量较高。用户可以根据需要添加注释或进行进一步的数据加工。
Hugging Face
2025-05-13 更新
10
0
zhan1993/mathqa_lora_soup_repo
数学问答
自然语言处理
这是一个包含四个字段的数据集:指令(instruction)、输入(input)、输出(output)和答案(answer),所有字段均为文本类型。数据集包含一个训练集,大小为286,917,563字节,共有395,000个示例。数据集的下载大小为142,874,579字节。
Hugging Face
2025-03-31 更新
9
0
sail/Sailcompass_data
多语言模型
自然语言处理
SailCompass数据集旨在为东南亚语言的大型语言模型提供可重复和鲁棒的评估。该数据集支持多种任务类别,包括文本分类、翻译、摘要、表格问答和多项选择,涵盖印度尼西亚语、泰语和越南语。数据集的规模在10K到100K之间。
Hugging Face
2024-06-13 更新
13
0
cowWhySo/reddit_top_comments
社交媒体广告
自然语言处理
该数据集包含了从2005年到2022年期间,从Reddit平台上选取的多个热门子版块(如AskReddit、worldnews等)的帖子及其最高赞评论。每个数据条目包括帖子标题(title)、帖子正文(selftext)、最高赞评论(top_comment)和所属子版块(subreddit)。数据集经过筛选,仅包含至少有一个赞的评论。数据集涵盖了多个非NSFW的子版块,但可能包含一些NSFW语言。
Hugging Face
2024-06-20 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广