Global Lake Level Database (GLLD)|湖泊水位监测数据集|环境研究数据集
收藏
- Global Lake Level Database (GLLD) 首次发表,标志着全球湖泊水位数据集的正式建立。
- GLLD 首次应用于气候变化研究,为全球湖泊水位变化提供了重要数据支持。
- GLLD 数据集进行了首次大规模更新,增加了更多湖泊的水位数据,提升了数据集的覆盖范围和精度。
- GLLD 被广泛应用于水资源管理和环境监测领域,成为全球湖泊研究的重要工具。
- GLLD 数据集再次更新,引入了新的数据处理技术和方法,进一步提高了数据的质量和可靠性。
- 1Global Lake Level Database, v1.0NOAA Great Lakes Environmental Research Laboratory · 2019年
- 2Global lake responses to climate change during the satellite eraUniversity of Wisconsin-Madison · 2020年
- 3Climate-driven variability in lake water storage at the pan-Arctic scaleUniversity of Waterloo · 2021年
- 4Global lake volume and water storage variability over the 20th and 21st centuriesUniversity of Copenhagen · 2022年
- 5The impact of climate change on global lake water levels: A reviewUniversity of Oxford · 2023年
中国区域交通网络数据集
该数据集包含中国各区域的交通网络信息,包括道路、铁路、航空和水路等多种交通方式的网络结构和连接关系。数据集详细记录了各交通节点的位置、交通线路的类型、长度、容量以及相关的交通流量信息。
data.stats.gov.cn 收录
AISHELL/AISHELL-1
Aishell是一个开源的中文普通话语音语料库,由北京壳壳科技有限公司发布。数据集包含了来自中国不同口音地区的400人的录音,录音在安静的室内环境中使用高保真麦克风进行,并下采样至16kHz。通过专业的语音标注和严格的质量检查,手动转录的准确率超过95%。该数据集免费供学术使用,旨在为语音识别领域的新研究人员提供适量的数据。
hugging_face 收录
MedChain
MedChain是由香港城市大学、香港中文大学、深圳大学、阳明交通大学和台北荣民总医院联合创建的临床决策数据集,包含12,163个临床案例,涵盖19个医学专科和156个子类别。数据集通过五个关键阶段模拟临床工作流程,强调个性化、互动性和顺序性。数据来源于中国医疗网站“iiYi”,经过专业医生验证和去识别化处理,确保数据质量和患者隐私。MedChain旨在评估大型语言模型在真实临床场景中的诊断能力,解决现有基准在个性化医疗、互动咨询和顺序决策方面的不足。
arXiv 收录
LIDC-IDRI
LIDC-IDRI 数据集包含来自四位经验丰富的胸部放射科医师的病变注释。 LIDC-IDRI 包含来自 1010 名肺部患者的 1018 份低剂量肺部 CT。
OpenDataLab 收录
Traditional-Chinese-Medicine-Dataset-SFT
该数据集是一个高质量的中医数据集,主要由非网络来源的内部数据构成,包含约1GB的中医各个领域临床案例、名家典籍、医学百科、名词解释等优质内容。数据集99%为简体中文内容,质量优异,信息密度可观。数据集适用于预训练或继续预训练用途,未来将继续发布针对SFT/IFT的多轮对话和问答数据集。数据集可以独立使用,但建议先使用配套的预训练数据集对模型进行继续预训练后,再使用该数据集进行进一步的指令微调。数据集还包含一定比例的中文常识、中文多轮对话数据以及古文/文言文<->现代文翻译数据,以避免灾难性遗忘并加强模型表现。
huggingface 收录