官方服务:
资源简介:
<p>外三长期医嘱单病历数据集,可应用在特征工程、监督学习、无监督学习、自然语言处理等方面。</p>
应用场景:
创建时间:
2024-04-17
相关数据集
prli/pubmed-full_chopped_pyt_llama_alpha_0-1
该数据集包含文本、元信息、句子扰动数量以及文档统计信息。文本是数据集的主要特征,元信息中包含了数据集的集合名称。文档统计信息详细记录了文档的优势分数、长度变化比例、原始句子长度、替换后的句子长度等多个统计数据。数据集分为验证集,验证集大小为4000个样本。
Hugging Face2025-10-14 更新130
line.10.9.10.10000
该数据集包含输入文本(input_text)和目标文本(target_text)两个字段,适用于研究文本生成任务。数据集分为训练集和验证集,其中训练集有10000个样本,验证集有1024个样本。数据集用于支持论文《Roll the dice & look before you leap: Going beyond the creative limits of next-token predicti
Hugging Face2025-05-27 更新90
MLP-SEMO/PT_eval_datasets_ver1
--- dataset_info: features: - name: text dtype: string - name: length dtype: int64 splits: - name: train num_bytes: 328410 num_examples: 700 download_size: 220563 dataset
Hugging Face2024-05-31 更新70
Dawnnn0429/MathInstruct-PoT-NumGLUE
该数据集包含三个字段:来源(source),指令(instruction)和输出(output),均为文本格式。数据集分为训练集和测试集两部分,其中训练集包含12126个示例,测试集包含1348个示例。数据集主要用于某种文本生成或处理任务,具体应用场景需结合字段内容和数据集划分进一步分析。
Hugging Face2025-11-12 更新100
ElementXMaster/conversational_data
该数据集包含文本字符串类型的特征,划分为训练集,共有2,866,645个示例,总大小为5,380,175,829字节。数据集的默认配置指定了训练集的数据文件路径。
Hugging Face2025-03-25 更新80



