digital-twin-dataset|数字孪生数据集|电力系统数据集
收藏数据集概述
数据集来源
该数据集包含从美国合作伙伴配电系统运营商收集的数据,数据已匿名化处理,删除了所有地理标识符。
数据集样本
- 下载地址: https://caltech.box.com/s/5baxy2ogbalqohpidh1lyxgnnxmv5tuc
- 内容: 样本数据集包含与完整数据集相同类型的数据,但覆盖的时间范围较小,适合初步实验。
- 存储位置: 下载后请将数据放置在
sample_dataset
文件夹中。
完整数据集
- 访问方式: 提交申请表单 https://forms.office.com/r/Ds6rKEtyTV
- 预计可用时间: 2025年2月
- 数据格式: 与样本数据集相同
数据类型
数据集包含以下四种类型的数据:
1. 幅值数据 (sample_data/magnitude
)
- 内容: 包含电流和电压的均方根幅值,不包含相位角信息。
- 采样间隔: 1秒
2. 同步相量数据 (sample_data/phasor
)
- 内容: 包含同步相量测量数据,以复数形式表示。
- 采样间隔: 10秒
3. 同步波形数据 (sample_data/waveform
)
- 内容: 包含原始点波测量数据,采样频率为2.5kHz。
- 波形长度: 约1秒
- 采样间隔: 每10秒一个波形,采样间隔约为400微秒
4. 网络和参数数据
- 内容: 包含时变电路拓扑和参数信息,如线路连接、变压器铭牌额定值和断路器状态。
- 物理资产网络: 模型化电路至单个组件,电力传输元素(如线路、变压器、开关)为图的边,母线为节点。
- 电气网络: 通过零阻抗和无限阻抗元素(如短线路、闭合/断开断路器)推导。
数据质量
- 同步精度: 现场测试显示,同步误差方差为0.625度。
- 传感器误差: 传感器误差通常小于0.5%,但在轻载电路中使用过大的电流互感器时误差较大。
- 数据缺失: 由于网络和电源中断、系统维护等原因,数据中偶尔存在缺失。
- 电路拓扑和参数: 实际中,配电系统操作员很少维护无错误的系统记录,部分信息为估计值。
快速开始与代码示例
- 加载数据: 参见
data_IO.ipynb
中的示例代码。 - 状态估计 (同步相量): 提供示例代码。
- 电压控制: 使用线性分布式流模型 (LinDistFlow) 进行电压控制。
- 状态估计 (同步波形): 提供示例代码,参见
code_examples/state_estimation_waveform.ipynb
。
引用
- IEEE: 待补充
- BibTex: 待补充
联系方式
- 邮箱:
digitaltwin@caltech.edu
- GitHub Issues: https://github.com/caltech-netlab/digital-twin-dataset/issues
- Pull requests: https://github.com/caltech-netlab/digital-twin-dataset/pulls
免责声明
数据的准确性或可靠性不作任何保证,提供者不承担任何责任。

Breast Cancer Dataset
该项目专注于清理和转换一个乳腺癌数据集,该数据集最初由卢布尔雅那大学医学中心肿瘤研究所获得。目标是通过应用各种数据转换技术(如分类、编码和二值化)来创建一个可以由数据科学团队用于未来分析的精炼数据集。
github 收录
中国交通事故深度调查(CIDAS)数据集
交通事故深度调查数据通过采用科学系统方法现场调查中国道路上实际发生交通事故相关的道路环境、道路交通行为、车辆损坏、人员损伤信息,以探究碰撞事故中车损和人伤机理。目前已积累深度调查事故10000余例,单个案例信息包含人、车 、路和环境多维信息组成的3000多个字段。该数据集可作为深入分析中国道路交通事故工况特征,探索事故预防和损伤防护措施的关键数据源,为制定汽车安全法规和标准、完善汽车测评试验规程、
北方大数据交易中心 收录
FER2013
FER2013数据集是一个广泛用于面部表情识别领域的数据集,包含28,709个训练样本和7,178个测试样本。图像属性为48x48像素,标签包括愤怒、厌恶、恐惧、快乐、悲伤、惊讶和中性。
github 收录
中国250米灌溉耕地分布数据集(2000-2020)
灌溉耕地分布是开展生态、水文和气候研究的关键数据,并在水土资源管理中具有特别重要的地位。通过半自动机器学习模型,融合多源遥感数据(包括耕地分布、植被指数、水稻田分布)、灌溉统计和调查数据,以及灌溉适宜性分析,生成了中国逐年、250米灌溉耕地分布图(CIrrMap250)。利用2万个参考样本和高分辨率灌溉取水数据,对灌溉耕地分布数据的精度进行评估。结果显示,CIrrMap250在2000年、2010年和2020年的总体精度为0.79-0.88,优于现有的同类产品。
国家青藏高原科学数据中心 收录
中国食物成分数据库
食物成分数据比较准确而详细地描述农作物、水产类、畜禽肉类等人类赖以生存的基本食物的品质和营养成分含量。它是一个重要的我国公共卫生数据和营养信息资源,是提供人类基本需求和基本社会保障的先决条件;也是一个国家制定相关法规标准、实施有关营养政策、开展食品贸易和进行营养健康教育的基础,兼具学术、经济、社会等多种价值。 本数据集收录了基于2002年食物成分表的1506条食物的31项营养成分(含胆固醇)数据,657条食物的18种氨基酸数据、441条食物的32种脂肪酸数据、130条食物的碘数据、114条食物的大豆异黄酮数据。
国家人口健康科学数据中心 收录