大數據案例
⑴ 大數據時代的案例分析
個案一
你開心他就買你焦慮他就拋
華爾街「德溫特資本市場」公司首席執行官保羅·霍廷每天的工作之一,就是利用電腦程序分析全球3.4億微博賬戶的留言,進而判斷民眾情緒,再以「1」到「50」進行打分。根據打分結果,霍廷再決定如何處理手中數以百萬美元計的股票。
霍廷的判斷原則很簡單:如果所有人似乎都高興,那就買入;如果大家的焦慮情緒上升,那就拋售。
這一招收效顯著——當年第一季度,霍廷的公司獲得了7%的收益率。
個案二
國際商用機器公司(IBM)估測,這些「數據」值錢的地方主要在於時效。對於片刻便能定輸贏的華爾街,這一時效至關重要。曾經,華爾街2%的企業搜集微博等平台的「非正式」數據;如今,接近半數企業採用了這種手段。
●「社會流動」創業公司在「大數據」行業生機勃勃,和微博推特是合作夥伴。它分析數據,告訴廣告商什麼是正確的時間,誰是正確的用戶,什麼是應該發表的正確內容,備受廣告商熱愛。
●通過喬希·詹姆斯的Omniture(著名的網頁流量分析工具)公司,你可以知道有多少人訪問你的網站,以及他們呆了多長時間——這些數據對於任何企業來說都至關重要。詹姆斯把公司賣掉,進賬18億美元。
●微軟專家吉拉德喜歡把這些「大數據」結果可視化:他把客戶請到辦公室,將包含這些公司的數據圖譜展現出來——有些是普通的時間軸,有些像蒲公英,有些則是鋪滿整個畫面的泡泡,泡泡中顯示這些客戶的粉絲正在談論什麼話題。
●「臉譜」數據分析師傑弗遜的工作就是搭建數據分析模型,弄清楚用戶點擊廣告的動機和方式。
處理和分析工具
用於分析大數據的工具主要有開源與商用兩個生態圈。
開源大數據生態圈:
1、Hadoop HDFS、HadoopMapRece, HBase、Hive 漸次誕生,早期Hadoop生態圈逐步形成。
2、. Hypertable是另類。它存在於Hadoop生態圈之外,但也曾經有一些用戶。
3、NoSQL,membase、MongoDb
商用大數據生態圈:
1、一體機資料庫/數據倉庫:IBM PureData(Netezza), OracleExadata, SAP Hana等等。
2、數據倉庫:TeradataAsterData, EMC GreenPlum, HPVertica 等等。
3、數據集市:QlikView、 Tableau 、 以及國內的Yonghong Data Mart 。
⑵ 關於大數據應用有什麼例子
大數據應用的關鍵,也是其必要條件,就在於"IT"與"經營"的融合,當然,這里的經營的內涵可以非常廣泛,小至一個零售門店的經營,大至一個城市的經營。以下是關於各行各業,不同的組織機構在大數據方面的應用的案例,在此申明,以下案例均來源於網路,本文僅作引用,並在此基礎上作簡單的梳理和分類。
大數據應用案例之:醫療行業
Seton Healthcare是採用IBM最新沃森技術醫療保健內容分析預測的首個客戶。該技術允許企業找到大量病人相關的臨床醫療信息,通過大數據處理,更好地分析病人的信息。
在加拿大多倫多的一家醫院,針對早產嬰兒,每秒鍾有超過3000次的數據讀取。通過這些數據分析,醫院能夠提前知道哪些早產兒出現問題並且有針對性地採取措施,避免早產嬰兒夭折。
它讓更多的創業者更方便地開發產品,比如通過社交網路來收集數據的健康類App。也許未來數年後,它們搜集的數據能讓醫生給你的診斷變得更為精確,比方說不是通用的成人每日三次一次一片,而是檢測到你的血液中葯劑已經代謝完成會自動提醒你再次服葯。
大數據應用案例之:能源行業
智能電網現在歐洲已經做到了終端,也就是所謂的智能電表。在德國,為了鼓勵利用太陽能,會在家庭安裝太陽能,除了賣電給你,當你的太陽能有多餘電的時候還可以買回來。通過電網收集每隔五分鍾或十分鍾收集一次數據,收集來的這些數據可以用來預測客戶的用電習慣等,從而推斷出在未來2~3個月時間里,整個電網大概需要多少電。
有了這個預測後,就可以向發電或者供電企業購買一定數量的電。因為電有點像期貨一樣,如果提前買就會比較便宜,買現貨就比較貴。通過這個預測後,可以降低采購成本。
維斯塔斯風力系統,依靠的是BigInsights軟體和IBM超級計算機,然後對氣象數據進行分析,找出安裝風力渦輪機和整個風電場最佳的地點。利用大數據,以往需要數周的分析工作,現在僅需要不足1小時便可完成。
⑶ 國內的數據挖掘,大數據的案例有哪些
從去年6月接觸大數據以來,我閱覽了大量關於「大數據」的文章,每天大概是80篇這樣一個量級。其中60%實在反復強調大數據概念,30%在借大數據的風炒作自己,剩下10%,有談技術的,有談硬體存儲的,有談解決方案,真要問有哪些是接地氣並且實實在在大數據解決問題的案例,那是少之又少。
BAT在談大數據,風投資本在談大數據,銀行/金融/保險在談大數據,IBM、微軟、EMC在談大數據,專家教授在談大數據,可是大數據真的讓我們的生活變得更美好了嗎?作為屌絲青年的我們真正感受到大數據的紅利了嗎?不管你信不信,我沒有感受到。也就是說,大數據落地到普通人身的長征,還沒走完。
我們日常生活中使用電腦、平板、手機的數據,被軟硬體伺服器採集加以使用,而我們卻沒有因為貢獻大數據而讓生活更智能,這不符合邏輯。
⑷ 大數據的應用案例以及未來發展趨勢
趕超發達國家的重要機遇
半個世紀以來,隨著計算機技術全面融入社會生活,信息爆炸已經積累到了一個開始引發變革的程度,不僅使世界充斥著比以往更多的信息,而且其增長速度也在加快。信息爆炸的學科如天文學和基因學,創造出來大數據這個概念,如今,這個概念幾乎應用到了所有人類智力與發展的領域中。21世紀是數據信息大發展的時代,移動互聯、社交網路、電子商務等極大拓展了互聯網的邊界和應用范圍,各種數據正在迅速膨脹並變大。互聯網(社交、搜索、電商)、移動互聯網(微博)、物聯網(感測器、智慧地球)、車聯網、GPS、醫學影像、安全監控、金融(銀行、股市、保險)、電信(通話、簡訊)都在瘋狂產生著數據,大數據時代已經到來。
當前全球和我國大數據都呈現了井噴式爆發性增長,大數據已經滲透到各個行業和業務職能領域,成為重要的生產因素,大數據的演進與生產力的提高有著直接的關系。其發展特點,一是數據量呈現指數級增長。二是不同行業的大數據內容和開發應用特點各有不同,如證券、投資服務以及銀行等金融服務領域擁有最高的平均數字化數據存儲量,通信和媒體公司、公共事業公司以及政府等組織也有規模顯著的數字化數據存儲,這些行業更加具有通過大數據來創造價值的潛力。三是可以預見到大數據高速增長的現有趨勢將繼續推動數據增長,例如在各部門和地區之間,企業正在加快收集數據的步伐,推動了傳統的事務資料庫的增長;醫療衛生等面向消費者的行業中,多媒體的廣泛使用刺激了大數據的增長;社交媒體的廣泛普及以及物聯網中應用的不斷創新都進一步推動了大數據不斷增長……這些相互交叉的動力刺激了數據的增長,並將繼續推動數據池的迅速擴張。
發展大數據及其相關服務業將成為新興經濟體特別是我國在戰略性新興產業領域發揮後發優勢趕超發達國家的重要機遇。只要條件具備,發展中經濟體能夠利用大數據發揮巨大的潛力。例如,亞洲地區移動手機用戶最多,終端設備最多,其中中國設備數量最多,個人位置數據在亞洲已經領先。此外,在IT資產方面,盡管一些新興市場組織落後於發達市場,但發展中經濟體可以用最新技術跳躍式前進。大數據的應用不僅僅是商務,通過用戶行為分析實現精準管理、科學決策和人性化服務是大數據的典型應用,大數據在各行各業特別是公共服務領域具有廣闊的應用前景,包括消費行業、金融服務、食品安全、醫療衛生、軍事、交通環保、電子商務、氣象等。發展大數據產業機遇可貴潛力巨大。從經濟和產業發展維度看大數據及相關產業發展的潛力,我國獨特的位勢和經濟社會高速穩定發展,給大數據及其應用帶來了巨大的發展空間。大數據在我國各領域和不同行業的應用潛力巨大、機遇重大。大數據的核心技術進展和大數據應用有可能帶來我國新興戰略性產業發展的新機遇。
信息服務業發展的重要推力
研究表明,大數據是繼傳統IT之後下一個提高生產率的技術前沿和信息服務業發展的重要推動力。大數據的使用將成為未來提高競爭力、生產力、創新能力以及創造消費者盈餘的關鍵要素。
例如醫療衛生行業,能夠利用大數據避免過度治療、減少錯誤治療和重復治療,從而降低系統成本、提高工作效率,改進和提升治療質量;公共管理領域,能夠利用大數據有效推動稅收工作開展,提高教育部門和就業部門的服務效率;零售業領域,通過在供應鏈和業務方面使用大數據,能夠改善和提高整個行業的效率;市場和營銷領域,能夠利用大數據幫助消費者在更合理的價格範圍內找到更合適的產品以滿足自身的需求,提高附加值。數據已經成為可以與物質資產和人力資產相提並論的重要的生產要素,伴隨著信息化發展,企業將收集更多的信息,從而帶來數據呈現指數級的增長。大數據在同時為商業和消費者創造價值方面有巨大的發展潛力。
大數據應用能夠發揮重要的經濟作用,不但有利於私人商業活動,更有利於國民經濟和公民。數據可以為世界經濟創造重要價值,提高企業和公共部門的生產率與競爭力,並為消費者創造大量的經濟剩餘。例如,能夠富有創造性而有效地利用大數據來提高效率和質量。麥卡錫公司研究報告指出,預計美國醫療行業每年通過數據獲得的潛在價值可超過3000億美元,能夠使得美國醫療衛生支出降低超過8%,充分利用大數據的零售商有可能將其經營利潤提高60%以上。通過利用大數據實現政府行政管理方面的運作效率提高。估計歐洲發達經濟體可以節省開支超過1000億歐元,其中尚不包括可以用來減少欺詐、錯誤以及稅差的影響作用。可以預見的是,隨著人們存儲、匯聚和組合數據然後利用其結果進行深入分析的能力超過以往,隨著越來越尖端技術的軟體與不斷提高的計算能力相結合,從數據中提取洞見的能力也在顯著提高。
大數據及其開發利用能夠催生新的產業形態,拓展成為戰略性新興產業的重要組成部分。大數據的生產、整合、開發利用具有廣泛的高附加值,可以形成和應用於各行業的關鍵發現,大數據的有效利用可以創造巨大的潛在價值,許多行業和承擔業務職能的組織可以利用大數據提高人力、物力資源的分配和協調能力,減少浪費,增加透明度,並促進新想法和新見解的產生。其價值一是提高透明度,讓利益相關方能夠更加容易地及時獲取信息,例如在公安部門,讓原本相互分離的部門之間更加容易地獲取相關數據,就可大大降低搜索和處理時間;在製造業,整合來自研發、工程和製造部門的數據以便實現並行工程,可以顯著縮短產品上市時間並提高質量。二是可以通過實驗來發現需求、暴露可變因素並提高業績。隨著組織創造並存儲更多數字形式的交易數據,並以實時或接近實時的方式收集更多准確而詳細的績效數據,組織能夠通過安排對比實驗,運用數據分析獲取更好的決策,例如在線零售商,通過將流量和銷售結合的試驗論證決定價格調整和促銷活動的制定。三是更加精準地組織市場,根據客戶需求細分人群。利用大數據使組織能夠對人群進行非常具體的細分,以便精確地定製產品和服務以滿足用戶需求。例如在公共部門如公共勞動力機構,利用大數據為不同的求職者提供工作培訓服務,確保採用最有效和最高效的干預措施使不同的人重返工作崗位。四是可以協助決策者更加科學地進行決策。大數據的自動處理能夠更好地為決策者提供更加精準恰當的決策支持,通過對大數據的自動處理來替換或支持人為決策。有些組織已經在通過分析來自客戶、雇員甚至嵌入產品中的感測器的整個數據集而做出更有效的決策。五是能夠創新商業模式、產品和服務。例如在醫療保健領域,通過分析病人的臨床和行為數據已經創造了瞄準最適當群體的預防保健項目。例如互聯網公司收集大量的在線行為數據,創新速度非常快。
應組織實施大數據產業專項
發展大數據及其相關服務業具有重要意義,有望使各個行業產生更多收益。隨著我國經濟和社會信息化的高速發展,不僅信息產業自身獲取了巨大的數據池,各個行業都存在利用大數據獲取價值的潛力。大數據促使信息化建設模式大轉變,結構化數據向非結構化數據演進,使得未來IT投資重點不再是建系統為核心,而是圍繞大數據為核心。政府和企業決策者應對大數據發展研究制定發展戰略和策略給予高度重視。
大數據真正的問題是大數據應用,讓大數據更有意義。目前大數據管理多從架構和並行等方面考慮,解決高並發數據存取的性能要求及數據存儲的橫向擴展,但對非結構化數據的內容理解仍缺乏實質性的突破和進展,這是實現大數據資源化、知識化、普適化的核心。非結構化海量信息的智能化處理包括自然語言理解、多媒體內容理解、機器學習等。例如2012年3月29日白宮發布美國政府的大數據計劃:通過提高從大型復雜的數據集中提取知識和觀點的能力,承諾幫助加快在科學與工程中的步伐,加強國家安全,並改變教學研究。
由此,我們提出組織實施大數據產業專項的初步設想。一是圍繞拓展新興信息服務業態,組織實施以大數據示範、加工、處理、整合和深加工的信息資源與內容服務業示範工程,面向重點行業和重點民生領域包括金融證券、醫療衛生、稅務海關、交通運輸、社會保障、電子商務等領域,開展大數據重大應用示範,提升基於大數據的公共服務能力;二是加快推動北斗導航核心技術研發和產業化,推動北斗導航與移動通信、地理信息、衛星遙感、移動互聯網等融合發展,支持位置信息服務市場拓展,完善北斗導航基礎設施,推進服務模式和產品創新,在重點區域和領域開展示範應用;三是大力發展地理信息產業,拓寬地理信息服務市場,推進大數據技術和服務模式融合創新,支持大數據服務創新和商業模式創新;四是組織實施基於大數據的信息內容加工服務業典型示範工程,包括關鍵技術產品產業化和大數據生產、轉換、加工、投送平台及專用工具的產業化項目,為豐富信息消費內容產品供給提供支撐;五是組織實施自主可控的大數據關鍵技術產品產業化項目,主要包括商業智能、數據倉庫、數據集市、元數據、可視化技術等。
⑸ 生活中的大數據例子
1、洛杉磯警察局和加利福尼亞大學合作利用大數據預測犯罪的發生。
目前位於美國加利福尼亞州的PredPol公司在某種程度上把利用大數據預測犯罪變成了現實。
PredPol 推出的犯罪活動預測軟體主界面是一張城市地圖,看起來與谷歌地圖相似。它會根據某一地區過往的犯罪活動統計數據,藉助特殊演算法,計算出某地發生犯罪的概率、犯罪類型,以及最有可能犯罪的時間段。
它還可以用紅色方框表示需要提高警惕的犯罪「熱點」地區,警方可以通過個人電腦、手機或平板電腦對其進行在線查看。
犯罪預測軟體實際上是從地震預測軟體進化而來的,它能處理大量犯罪數據,尤其是犯罪地點和犯罪時間,然後再聯系已知的犯罪行為,比如竊賊通常傾向於在他們最熟悉的社區犯罪等,最終給出一個較為完善的結果。
每次運算結束後,犯罪預測軟體會給出一張畫出了紅色方框的地圖,這些紅色方框代表盜竊行為可能發生的「熱點」地區,有些時候這些區域能准確地縮小至很小的范圍。
警察局的上司會吩咐屬下,當他們沒在處理報警電話時,就應該花時間在這些高危區域中巡邏,最好是每兩小時巡邏至少15分鍾。這樣做的重點更在於通過在軟體畫出的高危區中高調巡邏而降低犯罪,而非等案子發生後破案。
2、google流感趨勢(Google Flu Trends)利用搜索關鍵詞預測禽流感的散布。
Google流感趨勢(Google Flu Trends,GFT)是Google於2008年推出的一款預測流感的產品。Google認為,某些搜索字詞有助於了解流感疫情。Google流感趨勢會根據匯總的Google搜索數據,近乎實時地對全球當前的流感疫情進行估測。
3、麻省理工學院利用手機定位數據和交通數據建立城市規劃。
目前手機移動網路實現了城鄉空間區域的全覆蓋,城鄉人口中手機終端的持有率和使用率已經達到相當高的比例,手機定位數據契合了城鄉人口空間分布與活動規律的分析需求。
根據手機信號在真實地理空間上的覆蓋情況,將手機用戶時間序列的移動信號數據,映射至現實的地理空間位置,即可完整、客觀地還原出手機用戶的現實活動軌跡,從而挖掘得到人口空間分布與活動聯系特徵信息。
4、梅西百貨的實時定價機制。根據需求和庫存的情況,該公司基於SAS的系統對多達7300萬種貨品進行實時調價。
(5)大數據案例擴展閱讀
經李克強總理簽批,2015年9月,國務院印發《促進大數據發展行動綱要》(以下簡稱《綱要》),系統部署大數據發展工作。
《綱要》明確,推動大數據發展和應用,在未來5至10年打造精準治理、多方協作的社會治理新模式,建立運行平穩、安全高效的經濟運行新機制,構建以人為本、惠及全民的民生服務新體系,開啟大眾創業、萬眾創新的創新驅動新格局,培育高端智能、新興繁榮的產業發展新生態。
未來,數據科學將成為一門專門的學科,被越來越多的人所認知。各大高校將設立專門的數據科學類專業,也會催生一批與之相關的新的就業崗位。與此同時,基於數據這個基礎平台,也將建立起跨領域的數據共享平台,之後,數據共享將擴展到企業層面,並且成為未來產業的核心一環。
⑹ 大數據案例
亞馬遜在大數據這塊領域當屬三大巨頭之一,舉個例子吧
亞馬遜在客人購物的時候,購物頁面總是充滿了推薦物品,TA為客戶推薦的產品絕不是一個巧合。亞馬遜的推薦引擎完全是基於客戶在過去一段時間的購買行為所做的:客戶的購物車中所收藏的商品、客戶喜歡的商品、其它用戶瀏覽或購買的商品。利用大數據技術對以上數據進行分析,為每位客戶定製了專屬的個人主頁。
因為利用該策略,公司在其第三財政季度期間銷售增長27%,達到了131.8億美元,而去年同期的銷售額則為96億美元。
如果你還需要進一步了解,可以去前瞻產業研究院看看,裡面有挺多資料的
⑺ 大數據有哪些具體的應用案例
大數據有具體的應用案例還是很多的,比如 :
1、梅西百貨的實時定價機制。根據需求和庫存的情況,該公司基於SAS的系統對多達7300萬種貨品進行實時調價。
2. Tipp24 AG針對歐洲博彩業構建的下注和預測平台。該公司用KXEN軟體來分析數十億計的交易以及客戶的特性,然後通過預測模型對特定用戶進行動態的營銷活動。這項舉措減少了90%的預測模型構建時間。SAP公司正在試圖收購KXEN。
3. 沃爾瑪的搜索。自行設計了最新的搜索引擎Polaris,利用語義數據進行文本分析、機器學習和同義詞挖掘等。根據沃爾瑪的說法,語義搜索技術的運用使得在線購物的完成率提升了10%到15%。「對沃爾瑪來說,這就意味著數十億美元的金額。」Laney說。
4. 快餐業的視頻分析。該公司通過視頻分析等候隊列的長度,然後自動變化電子菜單顯示的內容。如果隊列較長,則顯示可以快速供給的食物;如果隊列較短,則顯示那些利潤較高但准備時間相對長的食品。
5. Morton牛排店的品牌認知。當一位顧客開玩笑地通過推特向這家位於芝加哥的牛排連鎖店訂餐送到紐約Newark機場(他將在一天工作之後抵達該處)時,Morton就開始了自己的社交秀。首先,分析推特數據,發現該顧客是本店的常客,也是推特的常用者。根據客戶以往的訂單,推測出其所乘的航班,然後派出一位身著燕尾服的侍者為客戶提供晚餐。
6. PredPol Inc.。PredPol公司通過與洛杉磯和聖克魯斯的警方以及一群研究人員合作,基於地震預測演算法的變體和犯罪數據來預測犯罪發生的幾率,可以精確到500平方英尺的范圍內。在洛杉磯運用該演算法的地區,盜竊罪和暴力犯罪分布下降了33%和21%。
7. Tesco PLC(特易購)和運營效率。這家超市連鎖在其數據倉庫中收集了700萬部冰箱的數據。通過對這些數據的分析,進行更全面的監控並進行主動的維修以降低整體能耗。
8. American Express(美國運通,AmEx)和商業智能。以往,AmEx只能實現事後諸葛式的報告和滯後的預測。「傳統的BI已經無法滿足業務發展的需要。」Laney認為。於是,AmEx開始構建真正能夠預測忠誠度的模型,基於歷史交易數據,用115個變數來進行分析預測。該公司表示,對於澳大利亞將於之後四個月中流失的客戶,已經能夠識別出其中的24%。
⑻ 什麼是大數據,大數據的典型案例有哪些
隨著大數據時代的到來,大數據早已被逐步的運用在我們生活中的方方面面,那麼除了之前眾所周知的大數據殺熟事件,對於大數據你還了解多少呢?科學運用案例你又知道多少?今天就跟隨千鋒小編一起來看看。
洛杉磯警察局和加利福尼亞大學合作利用大數據預測犯罪的發生。
google流感趨勢(Google Flu Trends)利用搜索關鍵詞預測禽流感的散布。
統計學家內特.西爾弗(Nate Silver)利用大數據預測2012美國選舉結果。
麻省理工學院利用手機定位數據和交通數據建立城市規劃。
梅西百貨的實時定價機制,根據需求和庫存的情況,該公司基於SAS的系統對多達7300萬種貨品進行實時調價。
……
種種的案例實在是太多,或許我們永遠說不完一樣,所以我們就來看一看大數據被科學運用的一個經典案例:
「啤酒與尿布」的故事產生於20世紀90年代的美國沃爾瑪超市中,沃爾瑪的超市管理人員分析銷售數據時發現了一個令人難於理解的現象:在某些特定的情況下,「啤酒」與「尿布」兩件看上去毫無關系的商品會經常出現在同一個購物籃中,這種獨特的銷售現象引起了管理人員的注意,經過後續調查發現,這種現象出現在年輕的父親身上。
如果這個年輕的父親在賣場只能買到兩件商品之一,則他很有可能會放棄購物而到另一家商店,直到可以一次同時買到啤酒與尿布為止。沃爾瑪發現了這一獨特的現象,開始在賣場嘗試將啤酒與尿布擺放在相同的區域,讓年輕的父親可以同時找到這兩件商品,並很快地完成購物;而沃爾瑪超市也可以讓這些客戶一次購買兩件商品、而不是一件,從而獲得了很好的商品銷售收入,這就是「啤酒與尿布」 故事的由來。
當然「啤酒與尿布」的故事必須具有技術方面的支持。1993年美國學者Agrawal提出通過分析購物籃中的商品集合,從而找出商品之間關聯關系的關聯演算法,並根據商品之間的關系,找出客戶的購買行為。艾格拉沃從數學及計算機演算法角度提 出了商品關聯關系的計算方法——Aprior演算法。沃爾瑪從上個世紀 90 年代嘗試將 Aprior 演算法引入到 POS機數據分析中,並獲得了成功,於是產生了「啤酒與尿布」的故事。
其實大數據,其影響除了以上列舉的方面外,它同時也能在經濟、政治、文化等方面產生深遠的影響,大數據可以幫助人們開啟循「數」管理的模式,也是我們當下「大社會」的集中體現,三分技術,七分數據,得數據者得天下。