SNAP Facebook Network Dataset|社交网络数据集|数据分析数据集
收藏
- SNAP Facebook Network Dataset首次发表,由斯坦福大学的SNAP项目组发布,该数据集包含了2011年5月Facebook用户之间的社交网络关系。
- 该数据集首次应用于社交网络分析研究,特别是在社区检测和信息传播模型方面,为学术界提供了宝贵的实证数据。
- 随着数据集的广泛应用,其在社交网络算法优化和用户行为预测研究中的重要性逐渐凸显,成为相关领域研究的基础数据之一。
- 数据集的更新版本发布,增加了更多的用户特征和互动数据,进一步丰富了研究者的分析维度。
- 该数据集在社交网络隐私保护和数据安全研究中发挥了重要作用,推动了相关技术的进步和应用。
- 随着大数据和人工智能技术的发展,SNAP Facebook Network Dataset在机器学习和深度学习模型训练中的应用日益增多,为新一代社交网络分析工具的开发提供了支持。
中国250米灌溉耕地分布数据集(2000-2020)
灌溉耕地分布是开展生态、水文和气候研究的关键数据,并在水土资源管理中具有特别重要的地位。通过半自动机器学习模型,融合多源遥感数据(包括耕地分布、植被指数、水稻田分布)、灌溉统计和调查数据,以及灌溉适宜性分析,生成了中国逐年、250米灌溉耕地分布图(CIrrMap250)。利用2万个参考样本和高分辨率灌溉取水数据,对灌溉耕地分布数据的精度进行评估。结果显示,CIrrMap250在2000年、2010年和2020年的总体精度为0.79-0.88,优于现有的同类产品。
国家青藏高原科学数据中心 收录
中文《诗歌总集》
这是一个收录所有中文诗词的数据集,旨在提供一个系统、完善、高质量的诗词数据集合。数据集包括诗词的收录、校正、鉴赏和评分,并标准化为统一的JSON格式。
github 收录
中国食物成分数据库
食物成分数据比较准确而详细地描述农作物、水产类、畜禽肉类等人类赖以生存的基本食物的品质和营养成分含量。它是一个重要的我国公共卫生数据和营养信息资源,是提供人类基本需求和基本社会保障的先决条件;也是一个国家制定相关法规标准、实施有关营养政策、开展食品贸易和进行营养健康教育的基础,兼具学术、经济、社会等多种价值。 本数据集收录了基于2002年食物成分表的1506条食物的31项营养成分(含胆固醇)数据,657条食物的18种氨基酸数据、441条食物的32种脂肪酸数据、130条食物的碘数据、114条食物的大豆异黄酮数据。
国家人口健康科学数据中心 收录
LIDC-IDRI
LIDC-IDRI 数据集包含来自四位经验丰富的胸部放射科医师的病变注释。 LIDC-IDRI 包含来自 1010 名肺部患者的 1018 份低剂量肺部 CT。
OpenDataLab 收录
PlantVillage Dataset
该数据集包含约54,305张植物叶子的图像,这些图像在受控环境下收集,涵盖14种不同的植物种类。数据集包含38种植物疾病类别和1种背景图像。
github 收录