航空航天配套企业供应链协同与产能匹配数据集供应链数据采集与治理:依托航天云网平台及标识解析体系,汇聚主机厂与配套企业间的供需数据、订单数据、交付数据与质量数据。参考棉纺供应链数据融合实践,建立统一的数据采集标准与交换协议,打通“需求—生产—交付—物流”全链条数据。 供应链图谱构建:基于复杂网络理论,构建航空航天产业链上下游的供应关系图谱。通过节点度中心性、中间中心性等网络指标,识别供应链网络中的关键节点与潜在风险传导路径。 产能匹配与优化算法:构建基于多目标优化的产能匹配模型,综合考虑配套企业的产能规模、技术适配度、地理位置、历史交付表现等多维因素,采用启发式搜索算法求解最优的产能分配方案。 供应链风险评估模型:建立涵盖供应集中度风险、产能冗余度风险、地理集中度风险、质量稳定风险的供应链韧性评估指标体系。基于层次分析法(AHP)与熵权法相结合的方式确定指标权重,生成供应链韧性综合评分。
多源异构工业数据实时采集与融合治理数据集多协议数据采集:采用工业互联网云边协同4层架构,封装OPC-UA、Modbus、CAN、MQTT等多种工业通信协议函数,实现边缘侧多源异构数据的实时采集与协议转换。支持毫秒级数据采集频率,适配高频振动、温度等传感器数据采集需求。
数据清洗与质量评估:基于规则引擎与机器学习相结合的方法,对采集数据进行异常值检测(如基于3σ准则或孤立森林算法)、缺失值填补(如插值法或基于时序预测的填补方法)、去重与一致性校验。建立数据质量多维度评估指标体系,自动标记数据质量标签。
多源数据融合治理:采用实体对齐与时序关联技术,将来自不同系统的数据按统一时间轴与实体维度进行关联融合。构建数据标准化映射规则库,将不同数据源的字段定义统一映射到标准数据模型,形成可追溯的融合治理链路。
动态更新机制:基于增量采集策略,在云端构建“贴源层—标准层—融合层”三层数据架构,支持数据的实时接入与增量更新,确保数据资产的时效性。
航天云网跨区域工业资源共享与交易撮合数据集数据采集与治理:依托航天云网INDICS平台及大数据融通治理平台,汇聚平台上跨区域的制造资源供给数据(设备台账、加工能力、检测资质、闲置产能等)、需求发布数据(加工需求、采购需求、技术服务需求等)以及历史交易数据(成交价格、服务周期、履约评价等)。参照制造资源特征提取方法,对多源异构数据进行结构化处理,构建统一的资源画像与需求画像标准。
资源特征编码与索引:参照ID3算法及分类预测方法,通过数据融合技术对资源端供给能力(加工精度、产能规模、响应速度、地理位置等)与需求端要求(工艺要求、交付期限、预算范围、质量等级等)进行特征提取与向量化编码,构建面向高维空间的资源—需求索引体系,实现高效的相似度计算与候选集召回。
智能匹配与撮合算法:构建基于多目标优化的供需匹配模型。首先通过基于密度的聚类算法对需求进行归类聚合,发现共性的资源需求模式;其次采用启发式搜索算法求解多约束条件下的最优匹配方案,最大化匹配成功率与综合满意度;在此基础上引入博弈论框架分析供需双方的议价行为,设计撮合交易机制以平衡各方利益,提升交易达成率。
贵州省区域产业链供应链韧性评估数据集数据清洗与治理:依托航天云网INDICS平台及大数据融通治理平台,对贵州工业云平台汇聚的超过14725家活跃企业的原始数据进行脱敏、归一化处理,解决多源异构数据的“孤岛”问题。涉及企业经营敏感数据时,严格进行匿名化与去标识化处理。
韧性评估模型构建:
网络结构分析:构建产业链上下游图谱,利用复杂网络算法计算节点度中心性、中间中心性,识别关键“卡脖子”节点。
抗压能力测度:引入外部冲击因子(如物流中断、原材料价格波动),基于时间序列分析(如VAR模型)模拟不同情景下的产出缺口与恢复时长。
替代性评估:基于标识解析与物资转码数据,计算同类配套资源的可替代指数,综合评估供应链的冗余度与弹性。
航天云网工业大数据安全防护与合规管理数据集数据采集规则:
采集航天云网平台各业务环节(研发设计、生产制造、经营管理、运行维护、平台运营等)产生的工业数据,涵盖设备运行数据、生产工艺数据、经营管理数据、用户行为数据等多类型数据。
采集数据安全相关的日志记录、访问控制记录、安全事件记录等,按统一的数据格式与时间戳标准进行归集。
数据分类分级规则:
参照《工业领域重要数据识别指南》YD/T 4981-2024,按照四阶段流程开展数据分类分级:数据资产梳理→重要数据识别→内部审批→重要数据目录备案。
重要数据识别聚焦数据的安全影响维度,包括与国家秘密相关、与国家安全相关、与行业发展安全相关、与工业领域出口管制物项相关、与行业特色相关、处理个人信息达到一定数量等识别维度
按一般数据、重要数据、核心数据三个级别进行分类标注,形成可动态更新的数据资产清单与重要数据目录。
基于云边协同的智能产线运行状态监测数据集边缘侧数据采集与预处理:采用“云-边-端”三层协同架构,在产线边缘侧部署数据采集与预处理节点。通过Wi-Fi无线采集单元与有线高频采集单元相结合的方式,实现对设备振动、温度、超声等参数的实时采集与特征提取。边缘侧完成数据清洗、异常过滤、特征计算(如时域特征、频域特征)等预处理操作,有效降低云端数据传输与存储压力。
云端数据建模与智能分析:云端构建基于机理模型与数据驱动相融合的设备健康监测模型。采用动态阈值建模方法,替代传统单一固定阈值报警方式,根据设备运行工况自适应调整报警阈值,降低误报率。融合自回归模型(AR)与时空关联分析,实现对设备性能衰退趋势的早期追踪与预警。
云边协同机制:边缘侧负责实时数据采集与快速响应(毫秒级),云端负责复杂模型训练与全局优化决策。采用联邦学习或模型下发机制,将云端训练好的模型参数定期同步至边缘侧,实现“云上训练、边端推理”的协同模式,满足产线实时性需求的同时持续优化模型精度。
报警与事件管理:建立多级报警分级机制(预警/告警/紧急),结合历史案例库与规则库,对报警事件进行智能诊断与处理建议推荐,实现运维知识的沉淀与复用。
贵州工业互联网平台用户行为分析与体验优化数据集数据采集与治理:依托航天云网INDICS平台及航天云网工业APP应用与推广监测平台,汇聚平台网页端、移动端、工业APP端等多终端的用户行为日志数据(页面访问、按钮点击、搜索查询、功能使用、表单提交等)、用户基础属性数据(所属行业、企业规模、岗位角色、地域分布等)以及业务结果数据(交易订单、服务订阅、培训参与等)。参照大数据用户行为分析技术规范,对多源行为日志数据进行清洗、去重、会话识别与路径补全,建立统一的数据埋点标准与用户ID映射体系,确保跨端、跨场景用户行为的完整关联。
用户行为建模与分析:采用基于神经网络的深度学习算法与序列模式挖掘方法,对用户操作序列进行建模,识别高频使用路径、典型操作模式与异常行为模式。构建“用户—功能—场景”三维分析矩阵,从用户活跃度、功能渗透率、转化漏斗、留存曲线等维度建立多层级指标体系,对用户体验进行量化评估,精准识别易用性差、操作路径冗长等体验瓶颈。
航天云网工业APP开发与应用效果评估数据集数据采集与治理:依托航天云网INDICS平台及“互联网+”和数字经济监测评估平台,汇聚航天云网上架工业APP的开发文档、代码库、测试报告、用户使用日志、用户评价反馈等多源数据。对数据进行脱敏清洗,建立统一的数据字段标准与关联映射关系。
评估指标体系构建:参照工信领域AI应用评估维度,从技术创新性(算法或模型创新性、技术融合度)、技术研发成熟度(模型成熟度、鲁棒性、稳定性)、交互性能(功能实用性、界面友好性、解决方案适用性)、降本增效性(效率提升率、成本降低率)等维度构建评估模型。结合工业软件应用成效评估方法,对每项功能点进行分项评估并构建评估矩阵。
综合评分与对比分析:通过预设的评估算法对多维评估指标进行加权计算,生成各工业APP的综合效能评分,并支持同类APP间的横向对比分析与趋势研判。
贵州省工业绿色低碳转型路径优化数据集数据采集与治理:依托工业互联网平台,汇聚贵州省重点行业企业的能源消耗数据(电、煤、气等)、生产工艺数据(原料配比、炉温、压力等工况参数)、污染物排放监测数据、设备运行状态数据等多源异构数据。参照磷化工领域能耗优化实践,对数据进行清洗、校验、缺失值填补及标准化处理,打破各生产环节的数据孤岛,构建覆盖“原料—生产—产品—能耗”全链条的高质量数据集。
模型构建与路径寻优:融合行业机理知识(工艺标准、反应动力学模型等)与AI预测算法,构建能耗预测与碳排放评估模型。采用“前馈+反馈”闭环调控逻辑,基于历史生产数据与实时工况数据,预测能耗指标、产品品质参数及碳排放趋势,并通过先进过程控制(APC)与实时优化(RTO)系统求解最优工艺参数组合。借鉴电力行业碳数据诊断与降碳寻优模型经验,综合运用大数据分析、聚类分析等技术,建立多场景降碳路径评估与推荐机制。
贵州中小企业数字化转型成本效益分析数据集数据采集规则:
成本数据:通过企业财务系统、项目台账等渠道采集数字化转型相关的软件采购费、硬件购置费、人员培训费、外部咨询费、系统运维费等投入数据,按年度、按项目维度归集。
效益数据:通过MES、ERP等系统采集生产效率指标(如单位工时产出)、运营成本指标(如库存周转率、订单处理周期)、销售数据等产出指标。
企业特征数据:采集企业规模(员工数、营收)、所属行业、转型阶段、系统覆盖率等分类变量,支持分群分析。
数据预处理规则:
对原始数据进行异常值检测与剔除、缺失值插补(如热卡插补或多重插补)等标准化处理。
对涉及企业商业机密的数据实施脱敏处理,确保数据合规流通。
对多源异构数据按统一的企业编码和时间戳进行对齐融合,形成可联合建模的面板数据结构。
核心算法说明:
成本效益量化模型:构建投入产出弹性模型,核算数字化转型投入与产出的边际关系。学术研究表明,当企业处于较小时规模阶段时,数字化投入产出弹性较高,随着企业规模增大而逐渐降低,本数据集通过分位数回归等方法捕捉这一非线性特征。
成本粘性分析:基于资源调整成本理论,考察企业在不同成本规模区间(如25%~50%、50%~