登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
zjrwtxtechstudio/o1data03
zjrwtxtechstudio/o1data03
收藏
Hugging Face
2024-12-10 更新
2024-12-14 收录
自然语言处理
问答系统
数据链接:
https://hf-mirror.com/datasets/zjrwtxtechstudio/o1data03
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
由CAMEL O1DataGene生成的问题-回答数据集。
Question-Answer dataset generated by CAMEL O1DataGene.
应用场景:
提供机构:
zjrwtxtechstudio
相关数据集
dataset-nli-tagalog-health
健康信息提取
自然语言处理
该数据集包含从Tagalog文章中提取的与健康相关的信息,如疾病、治疗方法或公共卫生指南。提取的内容被格式化为JSON格式,包含URL和相关前提。
github
2024-08-31 更新
16
0
toti97/MakeYourTrip_trainset_test
在线旅行服务
自然语言处理
该数据集包含一个名为prompt的字符串特征。数据集仅包含一个训练集分割,其中有1个示例,数据大小为7831字节。下载大小为4121字节,数据集总大小为7831字节。默认配置指定数据文件路径为data/train-*。
Hugging Face
2024-12-09 更新
3
0
ajikadev/uganda-court-speech
音频处理
自然语言处理
该数据集是一个包含音频和对应文本的数据集,分为训练集、验证集和测试集三个部分。每个部分包含不同数量的音频和文本示例,可用于语音识别等任务。
Hugging Face
2025-11-01 更新
1
0
ruliad/fineweb_350BT_chunk_44
自然语言处理
文本分析
--- dataset_info: features: - name: text dtype: string - name: id dtype: string - name: dump dtype: string - name: url dtype: string - name: date dtype: string - name
Hugging Face
2024-06-02 更新
4
0
UPDESH1
自然语言处理
多语言对话系统
UPDESH1是一个高质量的、大规模的合成指令遵循数据集,包含950万条数据点,覆盖13种印度语言。它包括多样化的推理和生成任务,重点在于增强长上下文和多轮对话能力,并提高与印度文化环境的契合度。数据集的创建采用了一种自下而上的生成策略,通过提示大型开源LLMs(参数≥235B)将数据生成扎根于语言特定的维基百科内容。评估结果显示,生成的数据质量高,但在人类评估中也指出了需要改进的特定领域。
arXiv
2025-09-25 更新
1
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广