连物联网数据都理不清楚还怎么搞大数据分析?
2017/4/7 9:05:37
数据即价值是目前计算机领域极其推崇的观念。数据无论多少都被归结为大数据,数据分析越来越热门,资本也对贴有大数据标签的公司趋之若鹜。数据如同流动的数字货币一样被一再的评估、追崇。
当物联网在行业开始落地和应用后,由于其数据产生的速度之快,种类之多,体量之巨大都会对现有云端技术架构、数据处理方式带来超乎想象的压力和挑战。
面对如此复杂的数据,传说中的 “数据即价值”将被 “有价值的数据”这一理性的认识所打破。
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?
静态数据与动态数据
单从数据的变化上来说,物联网数据可以分为静态数据和动态数据,静态数据多为标签类,地址类数据,RFID产生的数据多为静态数据,静态数据多以结构性、关系型数据库存储;动态数据是以时间为序列的数据,物联网动态数据的特点是每个数据都与时间有一一对应关系,并且这种关系在数据处理中尤其重要,这类数据存储通常采用时序数据库方式存储。
静态数据会随着传感器的增多,控制设备数量的增多而增加;动态数据不仅随设备数量,传感器数量增加而增加,还会随时间的增加而增加。
无论静态数据还是动态数据,在物联网1.0阶段数据的增长是线性的,并非是指数级的,但是因为物联网动态数据是连续不间断的,因此数据的量也是海量的。因此物联网1.0阶段数据的压力是可控的,并不是如宣传的那样不可数,不可控。
能源类/资产属性类/诊断类/信号类
就数据的原始特性来说,我们可以把物联网数据分为能源类数据、资产属性类数据、诊断类数据、信号类数据。
数据之间的关联性是不同数据之间的关系,数据之间的关系对了解整个系统的运行有着最直接的影响,数据之间的正确关系的梳理是系统有效运行,产生价值的基石。
数据之间的关联性可以从下面几个方面分析:
数据的时效性是指数据产生到其被清除的时间,数据时效性是由系统的实施部署所决定。数据可以被使用多次也可以被使用一次后就可以被清除。总体来说远程部署数据还是边缘部署数据影响着数据的时效性,通常边缘部署的数据时效性短,远程数据的时效性长。边缘部署需要的数据通常及时性强,但是边缘存储空间,计算能力弱因此不能长期保存;远程数据通常为历史性数据展示、计算分析,同时云端空间、计算的伸缩性强,因此数据时效性长。
数据的实时性也是数据时效性的一部分,实时性和数据的部署位置,数据的重要性以及传输方式都有关联性。
总结物联网中的各类数据及特性或者抽象其通用性的目的是为了更好的选择不同的物联网技术进行快速、有效的实施。以数据为中心的物联网解决方案甚至商业模式将会是物联网的主流设计思想。
下文将从数据如何采集,数据如何预处理、数据如何传输等不同的角度进行分析如何应用物联网的各种技术。
以数据流向为核心的设计思路
从数据流向来设计包括:数据采集、数据汇聚、数据传输、数据持久化、数据展示、数据处理、数据矫正、数据消费。