如果想要清晰大數(shù)據(jù)的技能,我們就需要明白分析什么數(shù)據(jù),也就是要了解大數(shù)據(jù)要分析的數(shù)據(jù)類型,總的來(lái)講主要有四大類:
交易數(shù)據(jù)(TRANSACTION DATA)
大數(shù)據(jù)平臺(tái)能夠獲取時(shí)間跨度更大、更海量的結(jié)構(gòu)化交易數(shù)據(jù),這樣就可以對(duì)更廣泛的交易數(shù)據(jù)類型進(jìn)行分析,不僅僅包括POS或電子商務(wù)購(gòu)物數(shù)據(jù),還包括行為交易數(shù)據(jù),例如Web服務(wù)器記錄的互聯(lián)網(wǎng)點(diǎn)擊流數(shù)據(jù)日志。
人為數(shù)據(jù)(HUMAN-GENERATED DATA)
非結(jié)構(gòu)數(shù)據(jù)廣泛存在于電子郵件、文檔、圖片、音頻、視頻,以及通過博客、維基,尤其是社交媒體產(chǎn)生的數(shù)據(jù)流,這些數(shù)據(jù)為使用文本分析功能進(jìn)行分析提供了豐富的數(shù)據(jù)源泉。
移動(dòng)數(shù)據(jù)(MOBILE DATA)
能夠上網(wǎng)的智能手機(jī)和平板越來(lái)越普遍。這些移動(dòng)設(shè)備上的App都能夠追蹤和溝通無(wú)數(shù)事件,從App內(nèi)的交易數(shù)據(jù)(如搜索產(chǎn)品的記錄事件)到個(gè)人信息資料或狀態(tài)報(bào)告事件(如地點(diǎn)變更即報(bào)告一個(gè)新的地理編碼)。
機(jī)器和傳感器數(shù)據(jù)(MACHINE AND SENSOR DATA)
這包括功能設(shè)備創(chuàng)建或生成的數(shù)據(jù),例如智能電表、智能溫度控制器、工廠機(jī)器和連接互聯(lián)網(wǎng)的家用電器。這些設(shè)備可以配置為與互聯(lián)網(wǎng)絡(luò)中的其他節(jié)點(diǎn)通信,還可以自動(dòng)向中央服務(wù)器傳輸數(shù)據(jù),這樣就可以對(duì)數(shù)據(jù)進(jìn)行分析。機(jī)器和傳感器數(shù)據(jù)是來(lái)自新興的物聯(lián)網(wǎng)(IoT)所產(chǎn)生的主要例子。來(lái)自物聯(lián)網(wǎng)的數(shù)據(jù)可以用于構(gòu)建分析模型,連續(xù)監(jiān)測(cè)預(yù)測(cè)性行為(如當(dāng)傳感器值表示有問題時(shí)進(jìn)行識(shí)別),提供規(guī)定的指令(如警示技術(shù)人員在真正出問題之前檢查設(shè)備)。