❶ 對大數據的全方位解讀
對大數據的全方位解讀
大數據是當下非常火爆的一個詞,人人都在談論大數據。但大數據的定義是什麼?它到底是如何出現的?它有什麼特別之處?它最大的應用領域在哪裡?它的發展方向是什麼?對於以上問題,其實大多數人是弄不清楚的。
1)大數據時代出現的必然性
大數據和雲計算這兩個詞經常被同時提到,很多人誤以為大數據和雲計算是同時誕生的、具有強綁定關系。其實這兩者之間既有關聯性,也有區別。雲計算指的是一種以互聯網方式來提供服務的計算模式,而大數據指的是基於多源異構、跨域關聯的海量數據分析所產生的決策流程、商業模式、科學範式、生活方式和關聯形態上的顛覆性變化的總和。大數據處理會利用到雲計算領域的很多技術,但大數據並非完全依賴於雲計算;反過來,雲計算之上也並非只有大數據這一種應用。
雲計算的起源可以追溯到 2003 年末 Amazon 公司工程師 Chris Pinkham 提交給 CEO Jeff Bezos 的一篇論文中的一個設想:將 Amazon 內部使用的計算基礎設施開放給全世界的開發者。次年 11 月,Amazon 發布了第一版雲計算服務:Simple Queue Service。Simple Queue Service 再往後發展至 2006 年,演變成立今天著名的 AWS(Amazon Web Sercice)。同在 2006 年,Google 公司 CEO Eric Schmidt 首次公開提出了「雲計算」(Cloud Computing)的這一概念,雲計算也在這一年開始變得廣為人知。
大數據這個詞的流行卻晚了好幾年——直到 2009 年,大數據這個說法才逐漸開始在互聯網圈內傳播。但僅僅在互聯網領域流行,仍然不足以引起普遍關注,因為純互聯網經濟畢竟只佔全球經濟總量的很小一部分。而大數據概念真正變得火爆,卻是因為美國奧巴馬政府在 2012 年高調宣布了其「大數據研究和開發計劃」——美國政府希望利用大數據解決一些政府部門面臨的非常重要的問題,該計劃由橫跨 6 個政府部門的 84 個子課題組成。這標志著大數據真正開始進入主流的傳統線下經濟。
大數據出現的時間點自有它深刻的原因。2009 年至 2012 年這段時間正是電子商務在包括中國在內的全球全面開花的幾年。眾所周知,互聯網領域有 3 大類商業模式:廣告、游戲和電子商務。而電子商務又是第 1個真正將純互聯網經濟與傳統經濟嫁接在一起誕生的混合模式。准確地說,正是互聯網與傳統經濟的碰撞,才真正催生出了今天幾乎全民關注的「大數據」。大數據橫跨了互聯網產業與傳統產業,而且大數據真正廣闊的應用領域其實也正是比純互聯網經濟大得多的傳統產業。
從數據量的角度來看,在電子商務模式出現以前,傳統企業的數量增長緩慢。傳統企業的數據倉庫中的數據大多數來自於交易型數據,而交易這種行為處於用戶消費決策漏斗的最底部,這就決定了交易前的各種瀏覽、搜索、比較等用戶行為數據的都量遠遠超過交易數據。電子商務模式使得企業可以採集到用戶的瀏覽、搜索、比較等行為,這就導致企業的數據規至少提升了一個數量級。現在日益流行的移動互聯網以及將來會流行的物聯網又必將使數據量提高兩三個數量級。從這個角度來講,大數據時代是必然會出現的。
從IT產業的發展來看,第一代IT巨頭大多是 2B 的,比如 IBM、Microsoft、Oracle、SAP 這類傳統IT企業;第二代IT巨頭大多是 2C 的,比如 Yahoo、Google、Amazon、Facebook 這類互聯網企業。一個有意思的現象是:大數據時代前,這兩類公司彼此之間基本是井水不犯河水,我們很少看見這兩類公司的老闆們在一起坐而論道;但在當前這個大數據時代,這兩類公司已經開始直接競爭。比如 Amazon 已經開始提供雲模式的數據倉庫服務,直接搶占 IBM、Oracle 的市場。這個現象出現的本質原因是:在互聯網巨頭的帶動下,傳統IT巨頭的客戶普遍開始從事電子商務業務,正是由於客戶進入了互聯網,所以傳統IT巨頭們不情願地被拖入了互聯網領域。如果他們不進入互聯網,他們業務必將萎縮。所以第三代IT巨頭可能會是 2B 與 2C 融合的IT公司。
2)大數據的核心內涵
大數據概念雖然非常火爆,但少有人真正理解大數據的核心內容。一個普遍而且嚴重的誤解就是:大數據= 數據大,即大數據就是量大的數據。事實上,除了數據量大這個字面意義,大數據還有兩個更重要的特徵:
1) 跨領域數據的交叉融合。相同領域數據量的增加是加法效應,不同領域數據的融合是乘法效應
2) 數據的流動。數據必須流動,流動產生價值
對於第 1) 點,百分點推薦系統研究中心實驗結果顯示:百分點公司有 3 家客戶,分別是從事服裝、化妝品和箱包銷售的電商,百分點向這 3 家客戶提供個性化商品推薦服務,即:百分點挖掘用戶的偏好,不同的用戶上同一家電商網站時,向他們展現不同的服裝、化妝品或箱包,從而提高電商的轉化率和客單價。我們做過兩種測試:
a) 將每家網站的數據隔離。當每家網站自身的數據量增加到以前的 4 倍時,推薦效果大約能提高 5%;
b) 將三家網站的數據在去除敏感信息之後進行某種融合。融合後的數據大致是與單家網站的數據的 3 倍,比第一種情況數據量還少。但利用融合後的數據進行數據挖掘時,推薦效果能提升 30%,而且推薦商品並未發生變化,仍然是:用戶上服飾類網站時只看見服裝、上化妝品網站時只看見化妝品、上箱包網站時只看見箱包。
解釋得詳細一點,上述實驗說明:對同一個消費者,如果我們要向其推薦服裝。第一種方法是我們根據他過去的 4 次購買服裝的行為來預測其下一次可能會購買的服飾;第二種方法是我們根據他過去分別購買服裝、化妝品和箱包的各 1 次行為來預測其下一次可能會購買的服飾。兩種方法的基於的用戶行數分別是 4 次和 3 次,但第二種方法的效果明顯更好。
對於第 2) 點,其實 10 多年前傳統企業開始做數據倉庫時,數據倉庫從業者經常強調一個觀點:企業級數據倉庫的目標是讓不同部門的數據流動起來,各個部門數據割裂,數據的價值就得不到發揮。到了今天的互聯網時代,我們發現即使企業已經打通了內部各個部門之間的數據,但與整個互聯網比起來,數據量仍然微乎其微,數據應該以互聯網為媒介在企業之間某種形式的流動。參照「企業級數據倉庫」的概念,現在已經開始出現了「互聯網數據倉庫」的概念:就是企業通過互聯網渠道將與自己相關的外部數據與內部數據進行整合,從而形成「互聯網數據倉庫」。百分點已經在零售與媒體領域比較成功地打造了「開放數據聯盟」,該聯盟的成員可以在公允、安全的情況下基於該聯盟建立起自己的「互聯網數據倉庫」,從而享用海量數據的價值。
3)大數據的應用領域
大數據的起源要歸功於互聯網與電子商務,但大數據最大的應用前景卻在傳統產業。一是因為幾乎所有傳統產業都在互聯網化,二是因為傳統產業仍然占據了國家 GDP 的絕大部分份額。
哪些傳統企業最需要大數據服務呢?至少有 3 類企業:
1) 對大量消費者提供產品或服務的企業
2) 做小而美模式的中長尾企業
3) 面臨互聯網壓力之下必須轉型的傳統企業
第 1) 類企業都需要利用大數據精準分析不同消費者的偏好,提高營銷和服務的質量;第 1) 類企業都需要利用大數據分析精準定位自己的客戶群;第 3) 類企業主要指哪些正在遭受來自互聯網的新玩家沖擊的傳統企業,此類企業自然都需要利用互聯網和大數據作為自我進化的工具。當然,第 3) 類企業與前 2 類企業有重疊。
具體來講,中國最需要大數據服務的行業就是受互聯網沖擊最大的產業,首先是線下零售業,其次是金融業。
受電商的沖擊,國內很多零售巨頭都增長嚴重放緩,甚至遭遇負增長,線下零售已經到了不得不變革的危機關頭。我們也看到了銀泰百貨、王府井百貨、萬達集團這些具有創新意識的傳統巨頭開始利用互聯網和大數據來改造線下商業。其中銀泰百貨以手機為載體、利用 O2O 方式進行雙線數據挖掘的創新非常值得借鑒。
而金融行業就更加特殊:金融業並不銷售任何實體商品,它自誕生起就是基於數據的產業。由於國家管制,金融業在前幾年享受了非常好的政策紅利,內部變革動力不足。而目前金融業已經逐漸開始放鬆管制,新興的金融機構必將利用互聯網以及大數據工具向傳統金融巨頭發起猛烈攻擊。而傳統金融機構在互聯網方面的技術積累和數據積累都不足,要快速應對新進入者的挑戰,必然需要大數據服務。我們也看到了中信銀行信用卡中心、招商銀行信用卡中心已經在開始利用互聯網大數據進行創新。
那麼傳統產業需要什麼樣的大數據服務呢?這主要包括 3 層:
1) 基於大數據的行業垂直應用。每個行業都有自己的特點,所以自然會存在行業應用的需求;
2) 顧客標簽與商品標簽的整理。不管什麼行業,都需要精細化整理自己顧客的屬性標簽以及商品屬性標簽,而且這些標簽必須能夠細化到單個顧客和單個商品。標簽是行業應用的基礎;
3) 企業內部和外部數據的整合與管理。要給顧客和商品打標簽,首先必須整合企業內部和外部數據,尤其是日益重要和龐大的外部數據。
圖:傳統企業需要的大數據服務
第 3 層和第 2 層的方法相對比較通用,行業特殊性相對較少。百分點已經在第 3 層和第 2 層做出了比較成熟的產品,並且也開始在第 1 層做出了一些具體的行業應用產品,比如針對服飾行業的時尚服飾搭配系統。
4)大數據的發展方向
大數據產業未來會向什麼方向發展?隨著數據逐漸成為企業的一種資產,數據產業會向傳統企業的供應鏈模式發展,最終形成「數據供應鏈」。拿鋼鐵產業來講,鐵礦石公司從礦場中挖出礦石,經過粗加工,賣給鋼鐵企業;鋼鐵企業再進行精細一點的加工,將板材、鋼條賣給下游製造業公司;這些製造業公司做出汽車、飛機、門窗、電腦等產品賣給下游公司。這個產業鏈中存在找礦、運輸、加工等諸多環節,每個環節都有對應的企業。
圖:傳統企業的供應鏈
在「數據供應鏈」中,存在數據、數據整合與挖掘工具以及數據應用這 3 大環節。數據就好比礦場的礦石;數據整合與挖掘工具就好比鋼廠的冶煉爐;而精準營銷、服飾搭配等數據應用就好比汽車、電腦等可以出售給消費者的產品。企業在數據供應、數據整合與挖掘、數據應用等所有環節都需要專業的服務。這里尤其有兩個明顯的現象:
1) 外部數據的重要性日益超過內部數據。在互聯互通的互聯網時代,單一企業的內部數據與整個互聯網數據比較起來只是滄海一粟;
2) 能提供包括數據供應、數據整合與加工、數據應用等多環節服務的公司會有明顯的綜合競爭優勢。
5) 什麼樣的大數據企業會勝出
常有大數據從業者以及投資人和我們探討一個問題:大數據產業中,什麼樣的企業會最終勝出?這是一個很難回答的問題,而且即使回答了,三五年內可能都無法判斷其正確性。但從「數據供應鏈」中的各個環節來分析,還是可以得出一些具有參考價值的結論。
1) 數據供應。在互聯網沒有流行的時代,企業做數據倉庫、商業智能、數據挖掘等系統時採用的數據基本都來自於企業內部,企業幾乎無法獲取外部數據,所以很少有專業的數據供應商。互聯網改變了這一局面,將來會有專業的數據供應商。但既然是因為互聯網的出現導致了數據供應商的出現,那麼反過來數據供應商就必須具有很強的互聯網基因;
2) 數據整合與挖掘。數據挖掘工具供應商在非互聯網時代就早已存在。但互聯網時代使得企業的數據量激增、數據類型發生極大變化(不同於傳統的來自於單一領域的結構化數據,互聯網數據以跨域的非結構化數據為主),傳統的數據挖掘工具供應商的技術和方法已經很難適應。要跟上時代的變化,數據挖掘技術與工具應用商必須具備互聯網公司的海量數據處理和挖掘的能力;
3) 數據應用。具體的行業應用與傳統行業的業務關系密切,要做好行業應用,最好需要有服務傳統行業的經驗,了解傳統行業的內部運作模式。這時候僅僅具有 2C 經驗的互聯網基因的公司又稍顯不足。
綜合起來看,如果一家大數據從業公司同時兼備互聯網數據獲取能力、互聯網技術、互聯網執行力,又有做 2B 服務的經驗,那麼這家公司將比較容易取得領先優勢。這個結論其實一點也不奇怪:如本文開篇所述,大數據本來就是互聯網與傳統產業碰撞時的產物。
用「方興未艾」這個詞來形容大數據產業的發展階段都還為時過早,目前的大數據產業只能說是小荷才露尖尖角。國內企業在第 1 代IT產業(硬體和軟體產業)中是明顯落後國外企業的;在第 2 代IT產業(互聯網產業)中,國內企業已經與國外企業差距不大甚至在很多方面超過了國外企業;希望在第 3 代IT產業(雲計算和大數據)浪潮中,國內企業能夠完全趕上並且超過國外企業,我們也認為這是很有可能的。
❷ 互聯網時代,都說大數據,那什麼是大數據
大數據(big data,mega
data),或稱巨量資料,指的是需要新處理模式才能具有更強的決策力、洞察力和流程優化能力的海量、高增長率和多樣化的信息資產。
在維克托·邁爾-舍恩伯格及肯尼斯·庫克耶編寫的《大數據時代》中大數據指不用隨機分析法(抽樣調查)這樣的捷徑,而採用所有數據進行分析處理。大數據的5V特點:Volume(大量)、Velocity(高速)、Variety(多樣)、Value(價值密度)、Veracity(真實性)。
❸ 如何用大數據做高效社會創新
隨著信息技術的飛速發展,各領域的數據量都在爆發式增長,尤其在雲計算、物聯網、移動互聯網等it技術得到廣泛應用之後,數據的增長實現了從量變到質變的轉型,大數據如浪潮般席捲而來,人類社會進入大數據時代。大數據不僅僅只是一次顛覆性的技術革命,更是一場思維方式、行為模式與治理理念的全方位變革,尤其在政府治理領域,大數據帶來了巨大的變革潛力和創新空間。在「全面深化改革,推進國家治理體系和治理能力現代化」的時代背景下,應充分重視大數據在政府治理中的重要價值,牢牢抓住大數據為政府治理提供的創新機遇,切實提高各級政府部門的治理能力。
一、大數據為政府治理理念轉型帶來新機遇
治理理念的轉型是提升政府治理能力的前提,理念的轉型需要新文化、新思維的融入,大數據所蘊含的數據文化與數據思維恰好可以為治理理念轉型提供突破口,基於大數據探索政府治理的多元、多層、多角度特徵,最終實現以政府為主體的政府管制理念向以協同共治、公共服務為導向的政府治理理念的轉型。在大數據時代,政府治理的依據不再是個人經驗和長官意志,而是實實在在的數據,在過去深入群眾、實地調研考察的基礎上,系統採集的客觀數據和實證分析的科學結果將成為最為重要的政府決策依據。「尊重事實、推崇理性、強調精確」的特徵和「用數據說話、用數據決策、用數據管理、用數據創新」的理念將成為政府治理理念轉型的核心要義。
二、大數據為政府治理模式創新帶來新機遇
大數據通過把數學演算法運用於海量數據,從數則做據中尋找相關關系,通過這種相關性預測事情發生的可能性,這是大數據方法論的核心思想。此外,依託於大數據技術和平台,通過外包、眾包等靈活的組織方式,可以推動政府治理的組織架構從科層、分割、封閉向開放、協同、合作轉型,因此把大數據的方法和手段引入到政府治理領域,是實現政府治理模式創新的有效路徑。基於上述方法論,大數據為政府治理模式創新帶來的新機遇主要包括:從粗放式管理到精細化治理、從單兵作戰型管理到協作共享型治理、從被動響應型管理到主動預見型治理、從電子政務管理到政府2.0治理、從風險隱蔽型管理到風險防範型治理,最終實現全面數據驅動的治理模式創新。
三、大數據為政府決策科學化帶來新機遇
隨著公共事務的日益復雜,僅憑個人感知已經很難全面了解所有正在發生的事情並做出正確判斷,政府部門想要提高決策的科學性,就需要把大數據思維與技術運用到政府治理與決策中,依靠大規模數據的收集來直觀呈現經殲茄濟社會運行規律,通過相應的數據挖掘來輔助政府部門進行科學決策。大數據為政府決策科學化帶來的機遇主要體現在兩個方面:首先,在決策的制定階段,大數據背景下,政府決策不再是個別領導幹部「拍腦袋」做出的,而是通過「用數據說話」,讓聽得見炮火的人(數據)做出決策,這樣的政府決策是在對客觀數據進行科學分析、充分了解客觀現實的基礎上做出的,這樣大孫改衡大提高了決策的精準性、適用性和科學化水平;其次,在決策實施效果的跟蹤反饋階段,通過物聯網和社交網路的普及,大量的客觀數據能夠快速匯集給決策者,通過這些數據對決策的實施過程和效果進行實時監控,能夠更全面地掌握決策的實施效果和下一步的改進方向。
四、大數據為政府服務效能提升帶來新機遇
提升政府服務效能是政府治理能力提升的重要支撐,也是大數據背景下服務型政府建設的關鍵所在,在政府治理的范疇下,提升政府服務效能主要包括政府部門行政審批的效率提升和公共服務產品的質量提高兩個方面。在提升行政審批效率方面,大數據可以打通各個政府部門的信息孤島,打破各部門數據的條塊分割,通過構建統一的政府行政審批雲平台,讓數據為老百姓「跑腿辦事」,省去了「跑斷腿、磨破嘴,辦事跑十幾個部門,蓋幾十個公章」的苦惱和無奈,這樣既提高了行政審批效率,又節約了政府開支。在提高公共服務產品質量方面,大數據通過對公共服務產品數據和服務對象數據的挖掘、分析,提升公共服務產品供給的精準化、分層化、個性化;通過公共數據的開放和兼容,讓公眾參與到公共服務產品設計、提供和監督等各個環節,實現公共服務產品質量的提高。