连物联网数据都理不清楚还怎么搞大数据分析
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?本文旨在给你提供一些方法论和启示。
数据即价值是目前计算机领域极其推崇的观念。数据无论多少都被归结为大数据,数据分析越来越热门,资本也对贴有大数据标签的公司趋之若鹜。数据如同流动的数字货币一样被一再的评估、追崇。
当物联网在行业开始落地和应用后,由于其数据产生的速度之快,种类之多,体量之巨大都会对现有云端技术架构、数据处理方式带来超乎想象的压力和挑战。
面对如此复杂的数据,传说中的 “数据即价值”将被 “有价值的数据”这一理性的认识所打破。
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?
静态数据与动态数据
单从数据的变化上来说,物联网数据可以分为静态数据和动态数据,静态数据多为标签类,地址类数据,RFID产生的数据多为静态数据,静态数据多以结构性、关系型数据库存储;动态数据是以时间为序列的数据,物联网动态数据的特点是每个数据都与时间有一一对应关系,并且这种关系在数据处理中尤其重要,这类数据存储通常采用时序数据库方式存储。
静态数据会随着传感器的增多,控制设备数量的增多而增加;动态数据不仅随设备数量,传感器数量增加而增加,还会随时间的增加而增加。
无论静态数据还是动态数据,在物联网1.0阶段数据的增长是线性的,并非是指数级的,但是因为物联网动态数据是连续不间断的,因此数据的量也是海量的。因此物联网1.0阶段数据的压力是可控的,并不是如宣传的那样不可数,不可控。
能源类/资产属性类/诊断类/信号类
就数据的原始特性来说,我们可以把物联网数据分为能源类数据、资产属性类数据、诊断类数据、信号类数据。
能源类数据:是指可以能耗相关的,或者是计算能耗所需的相关数据例如电流、电压、功率因子、频率、谐波等等。能源数据是物联网最关键的数据类型,物联网最终的目的之一就是节能,那么获取能源数据,理解能源数据,分析能源数据是物联网实施中必须的功能。能源采集设备也是物联网重要的设备之一。
资产属性类数据:资产类数据通常指硬件资产数据比如设备的规格、参数等属性,设备的位置信息,设备之间的从属关系等等。资产类数据主要用于资产管理,资产管理是工业物联网非常重要的功能甚至可以作为独立的系统研究,因为它可以和ERP系统、MES系统、物流等几乎所有的系统对接。
诊断类数据:诊断类数据是指设备运行过程中检测设备运行状态的数据,诊断类数据可以有两类:一类为设备运行参数,例如设备输入/输出值,这里通常为传统工业自动化类数据即OT技术相关类数据;另外一类为设备外围诊断数据,例如设备的表面温度、设备噪音、设备震动等等,值得提出的是外围诊断才是物联网技术体现的地方它包括新型传感器技术和物联网通讯技术。外围诊断数据是预测性维护的重要的元数据,也为深度控制模型提供依据,因此诊断类数据是我们需要着重关注的数据类型。
信号类数据:信号类数据或者告警类数据是目前工业领域使用最普及的数据,因为其直观、易懂、关键,同时在本地、远程同时告知。信号类数据容易被忽略,但是它是物联网所需要的、也是快速可以采集到、并对物联网系统提供重要参考价值的数据之一。
数据之间的关联性
数据之间的关联性是不同数据之间的关系,数据之间的关系对了解整个系统的运行有着最直接的影响,数据之间的正确关系的梳理是系统有效运行,产生价值的基石。
数据之间的关联性可以从下面几个方面分析:
时间关联性:即同一时刻的数据照相,数据是同一时刻系统产生的,它反映的是系统这一时刻的状态,从数据世界角度看,这个系统就是这一时刻的数据集合。数据照相体现的是系统静态展示;时间戳是这类数据关键的因素,因此要求各个数据获取的时间戳必须相同,时间戳是目前很多数据所缺失的,也是物联网实施中需要关注和解决的问题之一。
流程关联性:即一个点的数据进过一定时间后影响第二个点数据的产生,它体现的是系统动态的流程展示。数据之间的流程关系性需要模型提供,并在实施中进行修正。
数据的时效性
数据的时效性是指数据产生到其被清除的时间,数据时效性是由系统的实施部署所决定。数据可以被使用多次也可以被使用一次后就可以被清除。总体来说远程部署数据还是边缘部署数据影响着数据的时效性,通常边缘部署的数据时效性短,远程数据的时效性长。边缘部署需要的数据通常及时性强,但是边缘存储空间,计算能力弱因此不能长期保存;远程数据通常为历史性数据展示、计算分析,同时云端空间、计算的伸缩性强,因此数据时效性长。
数据的实时性也是数据时效性的一部分,实时性和数据的部署位置,数据的重要性以及传输方式都有关联性。
以数据为中心的物联网设计方法论
总结物联网中的各类数据及特性或者抽象其通用性的目的是为了更好的选择不同的物联网技术进行快速、有效的实施。以数据为中心的物联网解决方案甚至商业模式将会是物联网的主流设计思想。
下文将从数据如何采集,数据如何预处理、数据如何传输等不同的角度进行分析如何应用物联网的各种技术。
以数据流向为核心的设计思路
从数据流向来设计包括:数据采集、数据汇聚、数据传输、数据持久化、数据展示、数据处理、数据矫正、数据消费。
以数据生产/消费的为核心的设计思路
生产/消费为核心的设计思路多以云端业务为中心,尤其整合现有各个分散子系统为目标或者产业链上下游的协同操作,物联网的数据多以关键数据指标类型为主或者为起始数据角色。
1)下面为供应链的数据流设计思路。
2)下面为综合管理系统设计
了解物联网数据是什么,并能够提出相应的物联网技术,掌握有价值的数据是物联网方案技术层面的第一步。同样也是物联网技术最终的具象单元——“有价值的数据”。
数据分析咨询请扫描二维码
CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01某家企业10个人面试,有9个本科生……如何脱颖而出,除得体的举止和良好的沟通力外,证书成重要筹码,这也是很多人考证的关键所在。
2022-04-14