登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
大模型精调数据(问答)
大模型精调数据(问答)
收藏
江苏数据交易所
2026-01-30 收录
模型训练
家庭对话
数据链接:
https://exchange.jsdataex.com/trade-home/#/project/tradingMarket/productDetail?productId=2354
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
从公开渠道抓取家庭日常生活中的问答数据集以及价值观对齐数据集,为家用对话大模型提供训练语料,提升大模型的智能程度。
应用场景:
提供机构:
中科城市大脑数字科技(无锡)有限公司
搜集汇总
背景与挑战
背景概述
该数据集专注于大模型精调,包含从公开渠道收集的家庭日常生活问答及价值观对齐数据。它旨在为家用对话大模型提供训练语料,通过优化问答能力和价值观对齐,有效提升大模型的智能水平和实用性。
以上内容由遇见数据集搜集并总结生成
相关数据集
ALMA-13B-R
机器翻译
模型训练
该数据集是通过对比偏好优化方法训练的解码器模型,它使用了高质量的数据,专门用于翻译任务。在提出的集成方法中,该模型作为一个排名器,用以提升翻译质量。该数据集涉及的任务是机器翻译。
arXiv
6
0
clrp roberta base models tpu
自然语言处理
模型训练
roberta base models trained on clrp dataset using tpu
kaggle
2021-07-01 更新
5
0
GraftedCrab/finetuning_demo
机器学习
模型训练
该数据集包含一个名为prompt的字符串类型特征,主要用于训练目的。数据集分为一个训练集,包含40899个样本,总大小为16376961字节。数据集的下载大小为7034646字节。
Hugging Face
2024-11-21 更新
5
0
mnoukhov/summarize_from_feedback_tldr3_generated_20k_vllm_pythia1b_dpo
文本生成
模型训练
--- dataset_info: features: - name: prompt dtype: string - name: chosen dtype: string - name: rejected dtype: string splits: - name: train num_bytes: 37628107 num_examp
Hugging Face
2024-02-26 更新
6
0
MinhDR/dialogsum-train-1001-2000
对话处理
模型训练
--- dataset_info: features: - name: query dtype: string - name: dialogue dtype: string - name: summary dtype: string splits: - name: train num_bytes: 2002288 num_exampl
Hugging Face
2024-06-06 更新
5
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广