




版權(quán)說明:本文檔由用戶提供并上傳,收益歸屬內(nèi)容提供方,若內(nèi)容存在侵權(quán),請(qǐng)進(jìn)行舉報(bào)或認(rèn)領(lǐng)
文檔簡(jiǎn)介
畢業(yè)設(shè)計(jì)設(shè)計(jì)(論文)題目:大數(shù)據(jù)時(shí)代下專科教育的改革專業(yè)班級(jí):網(wǎng)絡(luò)安全121班學(xué)生姓名:嬌指導(dǎo)教師:唐建設(shè)計(jì)時(shí)間:2015年4月25日工業(yè)職業(yè)技術(shù)學(xué)院工業(yè)職業(yè)技術(shù)學(xué)院畢業(yè)設(shè)計(jì)(論文)任務(wù)書任務(wù)下達(dá)日期:設(shè)計(jì)(論文)題目:設(shè)計(jì)(論文)主要容和要求:指導(dǎo)教師簽字:指導(dǎo)教師簽字:教研室主任簽字:年月日年月日工業(yè)職業(yè)技術(shù)學(xué)院畢業(yè)設(shè)計(jì)(論文)指導(dǎo)教師評(píng)語評(píng)語:成績(jī):
指導(dǎo)教師簽名:年月日工業(yè)職業(yè)技術(shù)學(xué)院畢業(yè)設(shè)計(jì)(論文)答辯記錄學(xué)生系別專業(yè)班級(jí)設(shè)計(jì)(論文)題目說明書共頁,圖紙共答辯情況提出問題回答問題正確基本正確有一般性錯(cuò)誤有原則性錯(cuò)誤回答不清12345678
大數(shù)據(jù)時(shí)代下??平逃母母镎鹤钤缣岢觥按髷?shù)據(jù)”時(shí)代到來的是全球知名咨詢公司麥肯錫,麥肯錫稱:“數(shù)據(jù),已經(jīng)滲透到當(dāng)今每一個(gè)行業(yè)和業(yè)務(wù)職能領(lǐng)域,成為重要的生產(chǎn)因素。人們對(duì)于海量數(shù)據(jù)的挖掘和運(yùn)用,預(yù)示著新一波生產(chǎn)率增長(zhǎng)和消費(fèi)者盈余浪潮的到來?!薄按髷?shù)據(jù)”在物理學(xué)、生物學(xué)、環(huán)境生態(tài)學(xué)等領(lǐng)域以及軍事、金融、通訊等行業(yè)存在已有時(shí)日,卻因?yàn)榻陙砘ヂ?lián)網(wǎng)和信息行業(yè)的發(fā)展而引起人們關(guān)注。關(guān)鍵詞:大數(shù)據(jù)時(shí)代互聯(lián)網(wǎng)教育??平逃母顰bstractThefirstproposedtheadventoftheeraofbigdataisworld-renownedconsultingfirmMcKinsey,McKinseysaid:"datahaspenetratedintoeveryfieldoftoday'sindustriesandbusinessfunctionsandbecomeanimportantfactorofproduction.Peopleforthemassivedatamininganduse,indicatesanewwaveofproductivitygrowthandthearrivalofthewaveofconsumersurplus.""Bigdatainthefieldofphysics,biology,environmentalecology,militaryaffairs,finance,communication,etc.industryexisttherearedays,butbecauseofthedevelopmentoftheInternetandinformationindustryinrecentyearsandcausepeopleconcern.Keywords:BigdataeraInterneteducationCollegeeducationreformTOC\o"1-5"\h\z\o"CurrentDocument"1、大數(shù)據(jù)的由來1\o"CurrentDocument"2、大數(shù)據(jù)帶給我們的改變1\o"CurrentDocument"3、大數(shù)據(jù)的最新動(dòng)態(tài)1\o"CurrentDocument"4、在大數(shù)據(jù)時(shí)代下教育的改革2\o"CurrentDocument"5、在大時(shí)代下,學(xué)生應(yīng)該學(xué)習(xí)的技能知識(shí)4Hadoop4HPCC5\o"CurrentDocument"Storm6\o"CurrentDocument"ApacheDrill6\o"CurrentDocument"RapidMiner6PentahoBI7\o"CurrentDocument"6、大數(shù)據(jù)的未來以及學(xué)生的未來8\o"CurrentDocument"6.1國家政策下的未來發(fā)展8\o"CurrentDocument"6.2未來學(xué)生的發(fā)展91、大數(shù)據(jù)的由來大數(shù)據(jù)用于描述這樣的數(shù)據(jù)組,其規(guī)模超出了日常軟件在可容忍期限獲取、管理和加工數(shù)據(jù)的能力。一些網(wǎng)絡(luò)技術(shù)領(lǐng)先的公司持續(xù)地投資于昂貴的大數(shù)據(jù)技術(shù),成效顯著。大數(shù)據(jù)使得創(chuàng)新型公司變成了經(jīng)營新方法的率先接受者,經(jīng)營更為成功。通過大數(shù)據(jù)的分析挖掘,公司可以發(fā)現(xiàn)新的經(jīng)營模式,對(duì)工藝加以改進(jìn)。例如,在獲悉消費(fèi)者行為后,可以將發(fā)現(xiàn)用于某些改變,如降低成本或增加銷售,就會(huì)產(chǎn)生價(jià)值。在任意大的數(shù)據(jù)組中應(yīng)用統(tǒng)計(jì)方法可以發(fā)現(xiàn)有用信息,將這些信息商業(yè)化即可獲益。2、大數(shù)據(jù)帶給我們的改變大數(shù)據(jù)帶來的信息風(fēng)暴正在變革我們的生活、工作和思維,大數(shù)據(jù)開啟了一次重大的時(shí)代轉(zhuǎn)型,引發(fā)思維變革、商業(yè)變革和管理變革。大數(shù)據(jù)時(shí)代最大的轉(zhuǎn)變就是,放棄對(duì)因果關(guān)系的渴求,而取而代之關(guān)注相關(guān)關(guān)系,顛覆了千百年來人類的思維慣例,對(duì)人類的認(rèn)知和與世界交流的方式提出了全新的挑戰(zhàn)。大數(shù)據(jù)的核心就是預(yù)測(cè)。大數(shù)據(jù)將為人類的生活創(chuàng)造前所未有的可量化的維度。大量展示了谷歌、微軟、亞馬遜、IBM、蘋果、facebook、twitter、VISA等大數(shù)據(jù)先鋒們最具價(jià)值的應(yīng)用案例?!痹谖磥淼氖澜缋镂覀儗⒒钪粋€(gè)透明的世界里,我們的動(dòng)態(tài),行蹤都可以由數(shù)據(jù)組成,所有企業(yè)的經(jīng)營模式,服務(wù)模式,都將發(fā)生改變,但請(qǐng)別害怕,你要相信所有新技術(shù)的產(chǎn)生都是為了讓我們的生活更方面,更快捷!3、大數(shù)據(jù)的最新動(dòng)態(tài)大數(shù)據(jù)最核心的價(jià)值就是在于對(duì)于海量數(shù)據(jù)進(jìn)行存儲(chǔ)和分析。相比起現(xiàn)有的其他技術(shù)而言,大數(shù)據(jù)的“廉價(jià)、迅速、優(yōu)化”這三方面的綜合成本是最優(yōu)的。借著大數(shù)據(jù)時(shí)代的熱潮,微軟公司生產(chǎn)了一款數(shù)據(jù)驅(qū)動(dòng)的軟件,主要是為工程建設(shè)節(jié)約資源提高效率。在這個(gè)過程里可以為世界節(jié)約40%的能源。拋開這個(gè)軟件的前景不看,從微軟團(tuán)隊(duì)致力于研究開始,可以看他們的目標(biāo)不僅是為了節(jié)約了能源,更加關(guān)注智能化運(yùn)營。通過跟蹤取暖器、空調(diào)、風(fēng)扇以及燈光等積累下來的超大量數(shù)據(jù),捕捉如何杜絕能源浪費(fèi)。從海量數(shù)據(jù)中“提純”出有用的信息,這對(duì)網(wǎng)絡(luò)架構(gòu)和數(shù)據(jù)處理能力而言也是巨大的挑戰(zhàn)。在經(jīng)歷了幾年的批判、質(zhì)疑、討論、炒作之后,大數(shù)據(jù)終于迎來了屬于它的時(shí)代。2012年3月22日,奧巴馬政府宣布投資2億美元拉動(dòng)大數(shù)據(jù)相關(guān)產(chǎn)業(yè)發(fā)展,將“大數(shù)據(jù)戰(zhàn)略”上升為國家戰(zhàn)略。奧巴馬政府甚至將大數(shù)據(jù)定義為“未來的新石油”。大數(shù)據(jù)時(shí)代已經(jīng)來臨,它將在眾多領(lǐng)域掀起變革的巨浪。但我們要冷靜的看到,大數(shù)據(jù)的核心在于為客戶挖掘數(shù)據(jù)中蘊(yùn)藏的價(jià)值,而不是軟硬件的堆砌。因此,針對(duì)不同領(lǐng)域的大數(shù)據(jù)應(yīng)用模式、商業(yè)模式研究將是大數(shù)據(jù)產(chǎn)業(yè)健康發(fā)展的關(guān)鍵。我們相信,在國家的統(tǒng)籌規(guī)劃與支持下,通過各地方政府因地制宜制定大數(shù)據(jù)產(chǎn)業(yè)發(fā)展策略,通過國外IT龍頭企業(yè)以及眾多創(chuàng)新企業(yè)的積極參與,大數(shù)據(jù)產(chǎn)業(yè)未來發(fā)展前景十分廣闊[4]。4、在大數(shù)據(jù)時(shí)代下教育的改革在考試中,兩個(gè)同樣得了90分的考生,他們的能力完全一樣嗎?課堂上,老師告訴同學(xué)們,“完成第一題到第十題”。可是,真的是所有學(xué)生都有必要完成這10道題嗎?教學(xué)過程中,如何更好地啟發(fā)學(xué)生、如何更好地課堂互動(dòng),一節(jié)課的時(shí)長(zhǎng)究竟是40分鐘合適,還是45分鐘合適。這些問題,老師們是“憑經(jīng)驗(yàn)”,還是靠科學(xué)分析?如果你對(duì)以上問題有思考,那么,你就會(huì)對(duì)大數(shù)據(jù)對(duì)教育形態(tài)的改變持開放的心態(tài)。大數(shù)據(jù)時(shí)代悄然來臨,過去無法收集與分析的數(shù)據(jù)都被新的技術(shù)手段賦予了可能性。誰能對(duì)大數(shù)據(jù)的挖掘更為深刻,誰就會(huì)在行業(yè)發(fā)展中搶占先機(jī),教育領(lǐng)域也是如此。就在幾天前,慧科教育宣布在原來“開課吧”的基礎(chǔ)上正式上線“找座兒吧”,即在原來在線教育平臺(tái)的基礎(chǔ)上,又推出垂直的招聘平臺(tái)。從學(xué)習(xí)者職業(yè)性向的分析,到適合崗位的推薦,再到個(gè)性化設(shè)計(jì)的課程,經(jīng)過考核、認(rèn)證,最終推送到匹配的招聘崗位,完成了學(xué)習(xí)者從學(xué)習(xí)到求職的一整套完整路徑。這樣一套同以往學(xué)校教育截然不同的教育模式,引發(fā)了業(yè)的熱議,而這,正是基于對(duì)學(xué)習(xí)者個(gè)性化的數(shù)據(jù)分析完成的。兩個(gè)同樣考90分的考生,能力水平完全一樣嗎?大數(shù)據(jù)讓教育真正面對(duì)每一個(gè)獨(dú)立的個(gè)體“不得不承認(rèn),對(duì)于學(xué)生,我們知道得太少”這是卡耐基?梅隆大學(xué)教育學(xué)院的一句經(jīng)典的口號(hào),同時(shí)也是美國十大教育類年會(huì)關(guān)注度最高的議題。類似的思考在我們國家的教育領(lǐng)域同樣存在?!拔覀冋娴牧私夂⒆訂??”“每一個(gè)孩子都是獨(dú)特的,都是與眾不同的,但是我們能針對(duì)他們進(jìn)行真正個(gè)性化、差異化的教學(xué)嗎?”舉個(gè)簡(jiǎn)單的例子,兩個(gè)同樣在數(shù)學(xué)考試中取得90分的考生,他們的能力完全一樣嗎?根據(jù)傳統(tǒng)的教學(xué)模式,我們會(huì)認(rèn)為,成績(jī)相同的學(xué)生,能力大體相仿。但如果借用大數(shù)據(jù)的分析手段,學(xué)生的差異性就會(huì)清晰展現(xiàn)。根據(jù)對(duì)同為兩個(gè)90分的考生進(jìn)行分析,我們發(fā)現(xiàn),第一個(gè)學(xué)生更多的是依靠出色的邏輯思維,而另一名同學(xué)邏輯推理能力相對(duì)薄弱,是依靠出色的記憶力而獲得較好的成績(jī)。因此,大數(shù)據(jù)能夠讓我們更全面地看待學(xué)生的發(fā)展,發(fā)現(xiàn)以往考試成績(jī)所反映不了的深層次問題。當(dāng)然,如果老師能對(duì)這一情況及時(shí)掌握,就能對(duì)兩位同學(xué)開展不同的教學(xué)方式和方向。比如,通常老師布置作業(yè)的方式是,“請(qǐng)同學(xué)們完成第一題到第十題。”“請(qǐng)同學(xué)們?cè)诩倨谧x完這10本書”。把同樣的書目和同樣的題目布置給不同的學(xué)生,在傳統(tǒng)教育模式下無可厚非,但如果新技術(shù)已經(jīng)幫助我們對(duì)每一個(gè)學(xué)生的個(gè)性和特點(diǎn)都有了充分的了解,就會(huì)有針對(duì)性地布置作業(yè),進(jìn)而實(shí)現(xiàn)那個(gè)綿延2000多年的夢(mèng)想一因材施教。如A同學(xué)做對(duì)了第二題,系統(tǒng)馬上可以告訴他,他可以跳過第四題和第八題,這是因?yàn)?,二、四、八三道題目在考查同樣的知識(shí)點(diǎn),如果都做則是簡(jiǎn)單重復(fù)。如果B同學(xué)做錯(cuò)了第三題,那么系統(tǒng)就會(huì)提示他強(qiáng)化式練習(xí)第六題和第九題,這是因?yàn)榛诖髷?shù)據(jù)的分析,第三題做錯(cuò)的同學(xué)很有可能在第六題和第九題也出現(xiàn)錯(cuò)誤。而有針對(duì)性地反復(fù)訓(xùn)練,是十分必要的。5、在大時(shí)代下,學(xué)生應(yīng)該學(xué)習(xí)的技能知識(shí)大數(shù)據(jù)和大數(shù)據(jù)分析的產(chǎn)生,使他們對(duì)企業(yè)的影響有一個(gè)興趣高漲。大數(shù)據(jù)分析是研究大量的數(shù)據(jù)的過程中尋找模式,相關(guān)性和其他有用的信息,可以幫助企業(yè)更好地適應(yīng)變化,并做出更明智的決策。而我們?cè)诖髷?shù)據(jù)時(shí)代生活的計(jì)算機(jī)專業(yè)的學(xué)生,就必須學(xué)會(huì)如何捕捉數(shù)據(jù)甚至是要捕捉到有價(jià)值的,對(duì)企業(yè)有用的數(shù)據(jù),只有這樣,才能讓我們?cè)诠局邪l(fā)揮更重要的作用,才能對(duì)自己的未來進(jìn)行進(jìn)一步的規(guī)劃。以下便是現(xiàn)在國外對(duì)于收集數(shù)據(jù),處理數(shù)據(jù)最實(shí)用的6個(gè)參考軟件:5.1Hadoop[5]Hadoop是一個(gè)能夠?qū)Υ罅繑?shù)據(jù)進(jìn)行分布式處理的軟件框架。但是Hadoop是以一種可靠、高效、可伸縮的方式進(jìn)行處理的。Hadoop是可靠的,因?yàn)樗僭O(shè)計(jì)算元素和存儲(chǔ)會(huì)失敗,因此它維護(hù)多個(gè)工作數(shù)據(jù)副本,確保能夠針對(duì)Hadoop失敗的節(jié)點(diǎn)重新分布處理。Hadoop是高效的,因?yàn)樗圆⑿械姆绞焦ぷ?,通過并行處理加快處理速度。Hadoop還是可伸縮的,能夠處理PB級(jí)數(shù)據(jù)。此外,Hadoop依賴于社區(qū)服務(wù)器,因此它的成本比較低,任何人都可以使用。Hadoop是一個(gè)能夠讓用戶輕松架構(gòu)和使用的分布式計(jì)算平臺(tái)。用戶可以輕松地在Hadoop上開發(fā)和運(yùn)行處理海量數(shù)據(jù)的應(yīng)用程序。它主要有以下幾個(gè)優(yōu)點(diǎn):1?高可靠性。Hadoop按位存儲(chǔ)和處理數(shù)據(jù)的能力值得人們信賴。高擴(kuò)展性。Hadoop是在可用的計(jì)算機(jī)集簇間分配數(shù)據(jù)并完成計(jì)算任務(wù)的,這些集簇可以方便地?cái)U(kuò)展到數(shù)以千計(jì)的節(jié)點(diǎn)中。高效性。Hadoop能夠在節(jié)點(diǎn)之間動(dòng)態(tài)地移動(dòng)數(shù)據(jù),并保證各個(gè)節(jié)點(diǎn)的動(dòng)態(tài)平衡,因此處理速度非常快。高容錯(cuò)性。Hadoop能夠自動(dòng)保存數(shù)據(jù)的多個(gè)副本,并且能夠自動(dòng)將失敗的任務(wù)重新分配。Hadoop帶有用Java語言編寫的框架,因此運(yùn)行在Linux生產(chǎn)平臺(tái)上是非常理想的。Hadoop上的應(yīng)用程序也可以使用其他語言編寫,比如C++。5.2HPCCHPCC,HighPerformanceComputingandCommunications(高性能計(jì)算與通信)的縮寫。1993年,由美國科學(xué)、工程、技術(shù)聯(lián)邦協(xié)調(diào)理事會(huì)向國會(huì)提交了“重大挑戰(zhàn)項(xiàng)目:高性能計(jì)算與通信”的報(bào)告,也就是被稱為HPCC計(jì)劃的報(bào)告,即美國總統(tǒng)科學(xué)戰(zhàn)略項(xiàng)目,其目的是通過加強(qiáng)研究與開發(fā)解決一批重要的科學(xué)與技術(shù)挑戰(zhàn)問題。HPCC是美國實(shí)施信息高速公路而上實(shí)施的計(jì)劃,該計(jì)劃的實(shí)施將耗資百億美元,其主要目標(biāo)要達(dá)到:開發(fā)可擴(kuò)展的計(jì)算系統(tǒng)及相關(guān)軟件,以支持太位級(jí)網(wǎng)絡(luò)傳輸性能,開發(fā)千兆比特網(wǎng)絡(luò)技術(shù),擴(kuò)展研究和教育機(jī)構(gòu)及網(wǎng)絡(luò)連接能力。該項(xiàng)目主要由五部分組成:1、高性能計(jì)算機(jī)系統(tǒng)(HPCS),容包括今后幾代計(jì)算機(jī)系統(tǒng)的研究、系統(tǒng)設(shè)計(jì)工具、先進(jìn)的典型系統(tǒng)及原有系統(tǒng)的評(píng)價(jià)等;2、先進(jìn)軟件技術(shù)與算法(ASTA),容有巨大挑戰(zhàn)問題的軟件支撐、新算法設(shè)計(jì)、軟件分支與工具、計(jì)算計(jì)算及高性能計(jì)算研究中心等;3、國家科研與教育網(wǎng)格(NREN),容有中接站及10億位級(jí)傳輸?shù)难芯颗c開發(fā);4、基本研究與人類資源(BRHR),容有基礎(chǔ)研究、培訓(xùn)、教育及課程教材,被設(shè)計(jì)通過獎(jiǎng)勵(lì)調(diào)查者-開始的,長(zhǎng)期的調(diào)查在可升級(jí)的高性能計(jì)算中來增加創(chuàng)新意識(shí)流,通過提高教育和高性能的計(jì)算訓(xùn)練和通信來加大熟練的和訓(xùn)練有素的人員的聯(lián)營,和來提供必需的基礎(chǔ)架構(gòu)來支持這些調(diào)查和研究活動(dòng);5、信息基礎(chǔ)結(jié)構(gòu)技術(shù)和應(yīng)用(IITA),目的在于保證美國在先進(jìn)信息技術(shù)開發(fā)方面的領(lǐng)先地位。StormStorm是自由的開源軟件,一個(gè)分布式的、容錯(cuò)的實(shí)時(shí)計(jì)算系統(tǒng)。Storm可以非??煽康奶幚睚嫶蟮臄?shù)據(jù)流,用于處理Hadoop的批量數(shù)據(jù)。Storm很簡(jiǎn)單,支持許多種編程語言,使用起來非常有趣。Storm由Twitter開源而來,其它知名的應(yīng)用企業(yè)包括Groupon、淘寶、支付寶、阿里巴巴、樂元素、Admaster等等。Storm有許多應(yīng)用領(lǐng)域:比如實(shí)時(shí)分析、在線機(jī)器學(xué)習(xí)、不停頓的計(jì)算、分布式RPC(遠(yuǎn)過程調(diào)用協(xié)議,一種通過網(wǎng)絡(luò)從遠(yuǎn)程計(jì)算機(jī)程序上請(qǐng)求服務(wù))、ETL(Extraction-Transformation-Loading的縮寫,即數(shù)據(jù)抽取、轉(zhuǎn)換和加載)等等。Storm的處理速度驚人:經(jīng)測(cè)試,每個(gè)節(jié)點(diǎn)每秒鐘可以處理100萬個(gè)數(shù)據(jù)元組。Storm是可擴(kuò)展、容錯(cuò),很容易設(shè)置和操作。ApacheDrill為了幫助企業(yè)用戶尋找更為有效、加快Hadoop數(shù)據(jù)查詢的方法,Apache軟件基金會(huì)近日發(fā)起了一項(xiàng)名為“Drill”的開源項(xiàng)目。ApacheDrill實(shí)現(xiàn)了Google'sDremel.據(jù)Hadoop廠商MapRTechnologies公司產(chǎn)品經(jīng)理TomerShiran介紹,“Drill”已經(jīng)作為Apache孵化器項(xiàng)目來運(yùn)作,將面向全球軟件工程師持續(xù)推廣?!癉rill”項(xiàng)目其實(shí)也是從谷歌的Dremel項(xiàng)目中獲得靈感:該項(xiàng)目幫助谷歌實(shí)現(xiàn)海量數(shù)據(jù)集的分析處理,包括分析抓取Web文檔、跟蹤安裝在AndroidMarket上的應(yīng)用程序數(shù)據(jù)、分析垃圾、分析谷歌分布式構(gòu)建系統(tǒng)上的測(cè)試結(jié)果等等。通過開發(fā)“Drill”Apache開源項(xiàng)目組織機(jī)構(gòu)將有望建立Drill所屬的API接口和靈活強(qiáng)大的體系架構(gòu),從而幫助支持廣泛的數(shù)據(jù)源、數(shù)據(jù)格式和查詢語言。RapidMinerRapidMiner是世界領(lǐng)先的數(shù)據(jù)挖掘解決方案,在一個(gè)非常大的程度上有著先進(jìn)技術(shù)。它數(shù)據(jù)挖掘任務(wù)涉及圍廣泛,包括各種數(shù)據(jù)藝術(shù),能簡(jiǎn)化數(shù)據(jù)挖掘過程的設(shè)計(jì)和評(píng)價(jià)。RapidMiner的功能和特點(diǎn)1、免費(fèi)提供數(shù)據(jù)挖掘技術(shù)和庫2、100%用Java代碼(可運(yùn)行在操作系統(tǒng))3、數(shù)據(jù)挖掘過程簡(jiǎn)單,強(qiáng)大和直觀4、部XML保證了標(biāo)準(zhǔn)化的格式來表示交換數(shù)據(jù)挖掘過程5、可以用簡(jiǎn)單腳本語言自動(dòng)進(jìn)行大規(guī)模進(jìn)程6、多層次的數(shù)據(jù)視圖,確保有效和透明的數(shù)據(jù)7、圖形用戶界面的互動(dòng)原型8、命令行(批處理模式)自動(dòng)大規(guī)模應(yīng)用9、JavaAPI(應(yīng)用編程接口)10、簡(jiǎn)單的插件和推廣機(jī)制11、強(qiáng)大的可視化引擎,許多尖端的高維數(shù)據(jù)的可視化建模12、400多個(gè)數(shù)據(jù)挖掘運(yùn)營商支持耶魯大學(xué)已成功地應(yīng)用在許多不同的應(yīng)用領(lǐng)域,包括文本挖掘多媒體挖掘,功能設(shè)計(jì),數(shù)據(jù)流挖掘,集成開發(fā)的方法和分布式數(shù)據(jù)挖掘。5.6PentahoBIPentahoBI平臺(tái)不同于傳統(tǒng)的BI產(chǎn)品,它是一個(gè)以流程為中心的,面向解決方案(Solution)的框架。其目的在于將一系列企業(yè)級(jí)BI產(chǎn)品、開源軟件、API等等組件集成起來,方便商務(wù)智能應(yīng)用的開發(fā)。它的出現(xiàn),使得一系列的面向商務(wù)智能的獨(dú)立產(chǎn)品如Jfree'Quartz等等,能夠集成在一起,構(gòu)成一項(xiàng)項(xiàng)復(fù)雜的、完整的商務(wù)智能解決方案。PentahoBI平臺(tái),PentahoOpenBI套件的核心架構(gòu)和基礎(chǔ),是以流程為中心的,因?yàn)槠渲袠锌刂破魇且粋€(gè)工作流引擎。工作流引擎使用流程定義來定義在BI平臺(tái)上執(zhí)行的商業(yè)智能流程。流程可以很容易的被定制,也可以添加新的流程。BI平臺(tái)包含組件和報(bào)表,用以分析這些流程的性能。目前,Pentaho的主要組成元素包括報(bào)表生成、分析、數(shù)據(jù)挖掘和工作流管理等等。這些組件通過J2EEWebServiceSOAP、HTTP、JavaJavaScript、Portals等技術(shù)集成到Pentaho平臺(tái)中來。Pentaho的發(fā)行,主要以PentahoSDK的形式進(jìn)行。PentahoSDK共包含五個(gè)部分:Pentaho平臺(tái)、Pentaho示例數(shù)據(jù)庫、可獨(dú)立運(yùn)行的Pentaho平臺(tái)、Pentaho解決方案示例和一個(gè)預(yù)先配制好的Pentaho網(wǎng)絡(luò)服務(wù)器。其中Pentaho平臺(tái)是Pentaho平臺(tái)最主要的部分,囊括了Pentaho平臺(tái)源代碼的主體;Pentaho數(shù)據(jù)庫為Pentaho平臺(tái)的正常運(yùn)行提供的數(shù)據(jù)服務(wù),包括配置信息、Solution相關(guān)的信息等等,對(duì)于Pentaho平臺(tái)來說它不是必須的,通過配置是可以用其它數(shù)據(jù)庫服務(wù)取代的;可獨(dú)立運(yùn)行的Pentaho平臺(tái)是Pentaho平臺(tái)的獨(dú)立運(yùn)行模式的示例,它演示了如何使Pentaho平臺(tái)在沒有應(yīng)用服務(wù)器支持的情況下獨(dú)立運(yùn)行;Pentaho解決方案示例是一個(gè)Eclipse工程,用來演示如何為Pentaho平臺(tái)開發(fā)相關(guān)的商業(yè)智能解決方案。PentahoBI平臺(tái)構(gòu)建于服務(wù)器,引擎和組件的基礎(chǔ)之上。這些提供了系統(tǒng)的J2EE服務(wù)器,安全,portal,工作流,規(guī)則引擎,圖表,協(xié)作,容管理,數(shù)據(jù)集成,分析和建模功能。這些組件的大部分是基于標(biāo)準(zhǔn)的,可使用其他產(chǎn)品替換之。大的數(shù)據(jù)需要特殊的技術(shù),以有效地處理大量的容忍經(jīng)過時(shí)間的數(shù)據(jù)。適用于大數(shù)據(jù)的技術(shù),包括大規(guī)模并行處理(MPP)數(shù)據(jù)庫,數(shù)據(jù)挖掘電網(wǎng),分布式文件系統(tǒng),分布式數(shù)據(jù)庫,云計(jì)算平臺(tái),互聯(lián)網(wǎng),和可擴(kuò)展的存儲(chǔ)系統(tǒng)一些但不是所有的MPP的關(guān)系數(shù)據(jù)庫的PB的數(shù)據(jù)存儲(chǔ)和管理的能力。隱含的負(fù)載,監(jiān)控,備份和優(yōu)化大型數(shù)據(jù)表的使用在RDBMS的。6、大數(shù)據(jù)的未來以及學(xué)生的未來根據(jù)觀研天下監(jiān)測(cè)統(tǒng)計(jì),2011年全球數(shù)據(jù)總量已經(jīng)達(dá)到1.8ZB1ZB等于1萬億GB,1.8ZB也就相當(dāng)于18億個(gè)1TB移動(dòng)硬盤的存儲(chǔ)量,而這個(gè)數(shù)值還在以每?jī)赡攴环乃俣仍鲩L(zhǎng),預(yù)計(jì)到2020年全球?qū)⒖偣矒碛?5ZB的數(shù)據(jù)量,增長(zhǎng)近20倍。開源分析機(jī)構(gòu)Wikibon預(yù)計(jì),2012年全球大數(shù)據(jù)企業(yè)營收為50億美元,未來5年的市場(chǎng)復(fù)合年增長(zhǎng)率將達(dá)到58%,2017年將達(dá)到500億美元。6.1國家政策下的未來發(fā)展[6]據(jù)權(quán)威專家透露,在有關(guān)部門協(xié)商的基礎(chǔ)上,經(jīng)國務(wù)院同意,將來或推出一個(gè)國家科技和產(chǎn)業(yè)專項(xiàng)來引導(dǎo)和支持大數(shù)據(jù)的研究和產(chǎn)業(yè)發(fā)展。這個(gè)專項(xiàng)包括大數(shù)據(jù)的發(fā)展目標(biāo)、發(fā)展原則和重點(diǎn)任務(wù)。有關(guān)院士建議,我國大數(shù)據(jù)的發(fā)展目標(biāo)是,“十二五”時(shí)期以及未來十年,實(shí)現(xiàn)大數(shù)據(jù)產(chǎn)業(yè)技術(shù)創(chuàng)新,產(chǎn)業(yè)的整體質(zhì)量效益得到提升,應(yīng)用水平明顯提高,推動(dòng)經(jīng)濟(jì)社會(huì)發(fā)展。發(fā)展原則是,市場(chǎng)主導(dǎo)、創(chuàng)新發(fā)展;應(yīng)用牽引、融合發(fā)展。重點(diǎn)任務(wù)主要有布局關(guān)鍵技術(shù)、推進(jìn)示應(yīng)用、完善支持政策等三方面。首先,布局關(guān)鍵技術(shù)研發(fā)創(chuàng)新。一是以數(shù)據(jù)分析技術(shù)為核心,加強(qiáng)人工智能、商業(yè)智能、機(jī)器學(xué)習(xí)等領(lǐng)域的理論研究和技術(shù)研發(fā),夯實(shí)發(fā)展基礎(chǔ)。二是加快非結(jié)構(gòu)化數(shù)據(jù)處理技術(shù)、非關(guān)系型數(shù)據(jù)庫管理技術(shù)、可視化技術(shù)等基礎(chǔ)技術(shù)研發(fā),并推動(dòng)與云計(jì)算、物聯(lián)網(wǎng)、移動(dòng)互聯(lián)網(wǎng)等技術(shù)的融合,形成較為成熟、可行的解決方案。三是面向大數(shù)據(jù)應(yīng)用,加強(qiáng)網(wǎng)頁搜索技術(shù)、知識(shí)計(jì)算搜索技術(shù)、知識(shí)庫技術(shù)等核心技術(shù)的研發(fā),開發(fā)出高質(zhì)量的單項(xiàng)技術(shù)產(chǎn)品,并與數(shù)據(jù)處理技術(shù)相結(jié)合,為實(shí)現(xiàn)商業(yè)智能服務(wù)提供技術(shù)體系支撐。其二,加速推進(jìn)示應(yīng)用。
溫馨提示
- 1. 本站所有資源如無特殊說明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請(qǐng)下載最新的WinRAR軟件解壓。
- 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請(qǐng)聯(lián)系上傳者。文件的所有權(quán)益歸上傳用戶所有。
- 3. 本站RAR壓縮包中若帶圖紙,網(wǎng)頁內(nèi)容里面會(huì)有圖紙預(yù)覽,若沒有圖紙預(yù)覽就沒有圖紙。
- 4. 未經(jīng)權(quán)益所有人同意不得將文件中的內(nèi)容挪作商業(yè)或盈利用途。
- 5. 人人文庫網(wǎng)僅提供信息存儲(chǔ)空間,僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理,對(duì)用戶上傳分享的文檔內(nèi)容本身不做任何修改或編輯,并不能對(duì)任何下載內(nèi)容負(fù)責(zé)。
- 6. 下載文件中如有侵權(quán)或不適當(dāng)內(nèi)容,請(qǐng)與我們聯(lián)系,我們立即糾正。
- 7. 本站不保證下載資源的準(zhǔn)確性、安全性和完整性, 同時(shí)也不承擔(dān)用戶因使用這些下載資源對(duì)自己和他人造成任何形式的傷害或損失。
最新文檔
- 室外庭院涂料施工方案
- 機(jī)房 施工方案
- 開工施工方案
- 灘涂錨桿施工方案
- TSHJNXH 0014-2024 火力發(fā)電廠煙氣二氧化碳捕集系統(tǒng)(化學(xué)吸收法)能效評(píng)價(jià)方法
- TSHAEPI 003-2022 餐飲油煙在線監(jiān)測(cè)(光散射法)與監(jiān)控技術(shù)規(guī)范
- 二零二五年度解除影視制作解除擔(dān)保合同
- 二零二五年度個(gè)人債權(quán)轉(zhuǎn)讓及債務(wù)清收?qǐng)?zhí)行合作協(xié)議
- 二零二五年度跨境離婚協(xié)議書電子化執(zhí)行合同
- 二零二五年度子女自愿離婚協(xié)議書范本及離婚后子女監(jiān)護(hù)權(quán)
- 水庫移民安置檔案分類大綱與編號(hào)方案
- 衛(wèi)生和微生物基礎(chǔ)知識(shí)培訓(xùn)-
- 外徑千分尺檢定證書
- ICU輪轉(zhuǎn)護(hù)士培訓(xùn)計(jì)劃和手冊(cè)
- GB/T 9787-1988熱軋等邊角鋼尺寸、外形、重量及允許偏差
- GB/T 17614.1-2015工業(yè)過程控制系統(tǒng)用變送器第1部分:性能評(píng)定方法
- 財(cái)務(wù)工作督導(dǎo)檢查記錄表
- 輿情大數(shù)據(jù)監(jiān)測(cè)平臺(tái)建設(shè)方案
- CO2驅(qū)油后期氣竄機(jī)理及解決方法解讀課件
- 屏蔽泵知識(shí)-課件
- 醫(yī)療機(jī)構(gòu)主要負(fù)責(zé)人簽字表(示例)
評(píng)論
0/150
提交評(píng)論