了解大数据才能有效运用
相较於传统数据,大数据至少具有三个差异极大的特性。首先是数据量(Volume),如果换算成数位数据单位,基本单位通常已经是TB、PB等级,不但要考量收集及储存成本,如何迅速传递这麽庞大的数据,也是大数据应用必须思考的重点;其次是时效性(Velocity),即使是这麽大的数据量,仍然要在最短的时间内产生分析结果,如传统的年报统计,往往是在今年收集去年的数据,却在隔年才出版,旷日废时的结果,往往会让数据分析结果失真。
PredPol应用大数据分析技术,预测出犯罪机率高甚至下一次可能发生犯罪情况的区域,并於地图上标示出一块块500平方英尺的区域,供警察参考。
最後也是最大的差别,就是数据的多样性(Variety),传统的数据通常有明确的结构性,选项也比较少,如年龄、性别、等级等,但大数据可能会有各种形式,包括文字、影音、图像、网页等,不但没有明显的结构,而且大数据还常常出现形式交错的现象,如Youtube上的影片除了有点击数外,同时还有留言讨论。
由此可知,传统的数据收集方式,显然已经不能满足城市安防对於大数据的需求,所幸在物联网(InternetofThings;IoT)、云端运算及4G无线宽频等技术的发展下,要取得物与物、物与人、人与人的互联互通数据,技术上已不是问题,但必须得先迅速建构起收集、传递及储存大数据的基础建设,才有可能建立全面感知的能力,成为城市安防决策的最佳後盾。
但只是从感知层获取资讯是不够的,因为想要做好大数据深度分析,就必须要有能力针对复杂且开放式的问题寻找答案,并藉由视觉化分析工具,透过连续性的筛选和抽象化,才能洞悉重要资讯。然而大数据具有的超大量半结构化/非结构化数据的特性,往往会造成传统关联式数据库管理系统(RDBMS)的运作瓶颈,必须要导入全新的大数据分析工具,方能真正灵活运用大数据。
此外,大数据的价值既然远超过传统数据,大数据的真实、安全及稳定性,就必须加以重视。尤其是现在的网路应用无所不在,举凡机场、银行、捷运、车站、水电油气供应机制等,都可能被骇客入侵,加上政府为了能让掌握的数据更有价值,必须要采取公开透明的数据使用机制,当公共事业的数据开放愈多,可能被入侵的机会也愈高,因此想要利用大数据来解决城市安防的问题,首先就得先做好大数据的保护,因此资安技术的导入及专业人员的配置,绝对不能轻忽。
大数据对城市公共卫生及治安的帮助
目前已有许多欧美城市开始藉由蒐集及分析大量数据、预知可能出现的危机,进而作为城市安防的参考。如纽约的康乃尔大学威尔医学院(WeillCornellMedicalCollege)计算与系统生物医学助理教授ChristopherE.Mason的研究团队,花了18个月的时间在纽约400多个地铁站的车厢、楼梯扶手、座椅、灯杆、垃圾桶等地方蒐集样本,总共发现15,152种微生物,其中来自於人类的DNA只占0.2%,将近一半的样本是人类未知的有机生物,27%是活性且具有抗生素抗药性的细菌,所幸其中仅有12%会让人生病。
这项名为PhthoMap的研究计画,还透过华尔街日报网站提供互动地图,让使用者可以用来观看特定车站的研究成果,如收集的样本来源、微生物来源比例、细菌种类与说明等,也可利用搜寻细菌的种类,了解那些车站有这些细菌的存在,等於也展示了公卫数据开放使用的过程。