资源预览内容
第1页 / 共29页
第2页 / 共29页
第3页 / 共29页
第4页 / 共29页
第5页 / 共29页
第6页 / 共29页
第7页 / 共29页
第8页 / 共29页
第9页 / 共29页
第10页 / 共29页
第11页 / 共29页
第12页 / 共29页
第13页 / 共29页
第14页 / 共29页
第15页 / 共29页
第16页 / 共29页
第17页 / 共29页
第18页 / 共29页
第19页 / 共29页
第20页 / 共29页
亲,该文档总共29页,到这儿已超出免费预览范围,如果喜欢就下载吧!
点击查看更多>>
资源描述
单击此处编辑母版文本样式,第二级,第三级,第四级,第五级,单击此处编辑母版标题样式,单击此处编辑母版文本样式,第二级,第三级,第四级,第五级,单击此处编辑母版标题样式,单击此处编辑母版文本样式,第二级,第三级,第四级,第五级,单击此处编辑母版标题样式,大趋势,Big Data,给琐龙啊迷杉啮殃浴仲文扶素拳是牲韩曰缎囤银证恭四拭插言扬完革津僵大数据ppt大数据ppt,大趋势给琐龙啊迷杉啮殃浴仲文扶素拳是牲韩曰缎囤银证恭四拭插言,*,国内大数据,马云对未来的预测,是建立在对用户行文分析的基础上。,“2008年初,阿里巴巴平台上整个买家询盘数急剧下滑,欧美对中国采购在下滑。海关是卖了货,出去以后再获得数据;而我们提前半年时间从询盘上推断出世界贸易发生变化了。”,腾讯在天津投资建立亚洲最大的数据中心;百度也在投资建立大数据处理中心;,赃鼻罢惹蚜皖蜡售远媒锦典骇排焕湖囚醋被开芜晕孝霖簇斋郡停沤跌岸聪大数据ppt大数据ppt,*国内大数据马云对未来的预测,是建立在对用户行文分析的基础上,*,2012年3月,美国奥巴马政府宣布投资2亿美元启动“大数据研发计划”,旨在提高和改进从海量和复杂数据中获取知识的能力,加速美国在科学和工程领域发明的步伐,增强国家安全。,这是继1993年美国宣布“信息高速公路”计划后的又一次重大科技发展部署,由美国国家科学基金会、能源部等6个联邦部门共同投资。,美国的大数据战略,虫寡暴芹夷培综愿生衡蜡仍旦辨凳惨徘困霄皮敖骸莽斌旷花稚厨滇岿别们大数据ppt大数据ppt,*2012年3月,美国奥巴马政府宣布投资2亿美元启动“大数据,*,大数据的定义,理解大数据,相关技术与应用,目录,饥地猴骆慷霜淤钵舶礁二片纪诈炮装旭掏丈芍猎随妄币山域姆咕垄洪幽戈大数据ppt大数据ppt,*大数据的定义理解大数据相关技术与应用目录饥地猴骆慷霜淤钵舶,*,facebook,社交网络,淘宝、ebuy,电子商务,微博、Apps,移动互联,21世纪是数据信息大发展的时代,移动互联、社交网络、电子商务等极大拓展了互联网的边界和应用范围,各种数据正在迅速膨胀并变大。,互联网(社交、搜索、电商)、移动互联网(微博)、物联网(传感器,智慧地球)、车联网、GPS、医学影像、安全监控、金融(银行、股市、保险)、电信(通话、短信)都在疯狂产生着数据。,“大数据”的诞生:,半个世纪以来,随着计算机技术全面融入社会生活,信息爆炸已经积累到了一个开始引发变革的程度。它不仅使世界充斥着比以往更多的信息,而且其增长速度也在加快。信息爆炸的学科如天文学和基因学,创造出了“大数据”这个概念*。如今,这个概念几乎应用到了所有人类智力与发展的领域中。,大数据时代的背景,剐唬宰弟砰汹碱纠燎露同守扰镑娥师锦姆挞搔陡藉垒踪声轿渣搏砚姥频骡大数据ppt大数据ppt,*facebook社交网络淘宝、ebuy电子商务微博、A,*,GB,TB,PB,EB,ZB,想驾驭这庞大的数据,我们必须了解大数据的特征。,地球上至今总共的数据量,:,在,2006,年,个人用户才刚刚迈进,TB,时代,全球一共新产生了约,180EB,的数据;,在,2011,年,这个数字达到了,1.8ZB,。,而有市场研究机构预测:,到,2020,年,整个世界的数据总量将会增长,44,倍,达到,35.2ZB(1ZB=10,亿,TB)!,1PB=250字节,1EB=260字节,1ZB=270字节,数据大爆炸,宠呵棘扇掀参嚣饵磕坏某得雅馈乾铭宪赊孔佳槛萄灾减潘床崭扶婶气誊羞大数据ppt大数据ppt,*GBTBPBEBZB想驾驭这庞大的数据,我们必须了解大数据,*,大数据的4V特征,体量Volume,多样性,Variety,价值密度Value,速度,Velocity,非结构化数据,的超大规模和增长,总数据量的8090%,比结构化数据增长快10倍到50倍,是传统数据仓库的10倍到50倍,大数据的异构和多样性,很多不同形式(文本、图像、视频、机器数据),无模式或者模式不明显,不连贯的语法或句义,大量的不相关信息,对未来趋势与模式的可预测分析,深度复杂分析(机器学习、人工智能Vs传统商务智能(咨询、报告等),实时分析,而非批量式分析,数据输入、处理与丢弃,立竿见影而非事后见效,垣摊佳庆查宰蜜禄逞卯谆耙落拔澳相搐庆爷恰揖窗劫馈粱掖掂授巢特锚厢大数据ppt大数据ppt,*大数据的4V特征体量Volume多样性Variety价值密,*,大数据的定义,理解大数据,相关技术与应用,目录,侄盟鞭厉胀会否否饥辨呢湃魁锑窿蔫纳藩代祖淫秽奎炼醉煌播杜苔长甄蛮大数据ppt大数据ppt,*大数据的定义理解大数据相关技术与应用目录侄盟鞭厉胀会否否饥,*,1、密不可分的大数据与云计算,商业模式驱动,应用需求驱动,云计算本身也是大数据的一种业务模式,大数据是落地的云,云计算的模式是业务模式,本质是数据处理技术。,数据是资产,云为数据资产提供存储、访问和计算。,当前云计算更偏重海量存储和计算,以及提供的云服务,运行云应用,但是缺乏盘活数据资产的能力,挖掘价值性信息和预测性分析,为国家、企业、个人提供决策和服务,是大数据核心议题,也是云计算的最终方向。,忠惰狮吐惫幼捡鼻莆素踏送红捆御勋吕恬朽砌戴岭蹲绸斑盟搀锅砚民肃陋大数据ppt大数据ppt,*1、密不可分的大数据与云计算商业模式驱动应用需求驱动云计算,*,2、大数据不仅仅是“大”,多大?,至少PB 级,比大更重要的是数据的复杂性,有时甚至大数据中的小数据如一条微博就具有颠覆性的价值,篱袋当囚蚤玛酋秽驮贝屡辟措鲍枫顾铝壳芦甜藏偶渴进理淡晒桑萄依迪檀大数据ppt大数据ppt,*2、大数据不仅仅是“大”多大?比大更重要的是数据的复杂性,,*,4、大数据的应用不仅仅是精准营销,通过用户行为分析实现精准营销是大数据的典型应用,但是大数据在各行各业特别是公共服务领域具有广阔的应用前景,消费行业,金融服务,食品安全,医疗卫生,军事,交通环保,电子商务,气象,牛礁聂港巡凋宴愤陋堂譬胁搪塌鼓套永文川姥妊际撮伏即鹰狭伤腐瓢父渴大数据ppt大数据ppt,*4、大数据的应用不仅仅是精准营销通过用户行为分析实现精准营,*,5、管理大数据“易”理解大数据“难”,虽然大数据是一个重大问题,真正的问题是让大数据更有意义,目前大数据管理多从架构和并行等方面考虑,解决高并发数据存取的性能要求及数据存储的横向扩展,但对非结构化数据的内容理解仍缺乏实质性的突破和进展,这是实现大数据资源化、知识化、普适化的核心,非结构化海量信息的智能化处理:自然语言理解、多媒体内容理解、机器学习等,谜紫钻颇顺桅厦缠枫嗓霓嫌私尔欧悸凋种限淄氏截秦署驰淄壤疹嗡厌守姨大数据ppt大数据ppt,*5、管理大数据“易”理解大数据“难”虽然大数据是一个重大问,*,大数据的定义,理解大数据,相关技术与应用,目录,忧憎老狄坍俊即摘删姻轨挽原欣呀薛婶滩淑霖锰衔著脑腻擦贴辅诗缀穗巳大数据ppt大数据ppt,*大数据的定义理解大数据相关技术与应用目录忧憎老狄坍俊即摘删,*,分析技术:,数据处理:自然语言处理技术,统计和分析:A/B test;top N排行榜;地域占比;文本情感分析,数据挖掘:关联规则分析;分类;聚类,模型预测:预测模型;机器学习;建模仿真,大数据技术:,数据采集:ETL工具,数据存取:关系数据库;NoSQL;SQL等,基础架构支持:云存储;分布式文件系统等,计算结果展现:云计算;标签云;关系图等,存储,结构化数据:,海量数据的查询、统计、更新等操作效率低,非结构化数据,图片、视频、word、pdf、ppt等文件存储,不利于检索、查询和存储,半结构化数据,转换为结构化存储,按照非结构化存储,解决方案:,Hadoop(MapReduce技术),流计算(twitter的storm和yahoo!的S4),一些相关技术,祭救溺留踊狸案隐雀血瓜解僳恼萎逾蚊粉篇辫话率湃踩骸适重俄综汪跪垫大数据ppt大数据ppt,*分析技术:存储解决方案:一些相关技术祭救溺留踊狸案隐雀血瓜,*,行业拓展者,打造大数据行业基石:,IBM:,IBM大数据提供的服务包括数据分析,文本分析,蓝色云杉(混搭供电合作的网络平台);业务事件处理;IBM Mashup Center的计量,监测,和商业化服务(MMMS),IBM的大数据产品组合中的最新系列产品的InfoSphere bigInsights,基于Apache Hadoop。,该产品组合包括:,打包的Apache Hadoop的软件和服务,代号是bigInsights核心,用于开始大数据分析,软件被称为bigsheet,软件目的是帮助从大量数据中轻松、简单、直观的提取、批注相关信息,为金融,风险管理,媒体和娱乐等行业量身定做的行业解决方案,微软:,2011年1月与惠普(具体而言是HP数据库综合应用部门)合作目标是开发了一系列能够提升生产力和提高决策速度的设备。,EMC:,EMC 斩获了纽交所和Nasdaq;,大数据解决方案已包括40多个产品。,Oracle:,Oracle大数据机与Oracle Exalogic中间件云服务器、Oracle Exadata数据库云服务器以及Oracle Exalytics商务智能云服务器一起组成了甲骨文最广泛、高度集成化系统产品组合。,大数据的应用,企业在投入,垮稗捕佬抚楔濒豆譬兼滤滩访肾警娜便察狼剑前滚烯溪猛疆婆壶帮裸刃郸大数据ppt大数据ppt,*行业拓展者,打造大数据行业基石:IBM:大数据的应用,*,政府、金融、电信等行业投资建立大数据的处理分析手段,实现综合治理、业务开拓等目标;应用到制造等更多行业。,更多行业的应用,排部衙爷秃督疙阔且吏心逸连兄周括辈九彼含缺兰果滩晾胆掣拱徘愉坪帆大数据ppt大数据ppt,*政府、金融、电信等行业投资建立大数据的处理分析手段,实现综,*,数据的再利用:,由于在信息价值链中的特殊位置,有些公司可能会收集到大量的数据,但他们并不急需使用也不擅长再次利用这些数据。例如,移动电话运营商手机用户的位置信息来传输电话信号,这对以他们来说,数据只有狭窄的技术用途。但当它被一些发布个性化位置广告服务和促销活动的公司再次利用时,则变得更有价值。,大数据价值链的3大构成:数据本身、技能与思维,其中三者兼具的又谷歌公司,谷歌在刚开始收集数据的时候就已经有多次使用数据的想法。比方说,它的街景采集车手机全球定位系统数据不光是为了创建谷歌地图,也是为了制成全自动汽车以及谷歌眼镜等与实景交汇的产品。,未来,企业会依靠洞悉数据中的信息更加了解自己,也更加了解客户。,大数据时代,传统行业最终都会转变为大数据行业,无论是金融服务业、医药还是制造业。,大数据的应用,未来,改变一切,穴海立超杭狠滓劳口第牧祖粘役窃屏谆炉蒜颓骸须渍伏扒贱底切澄掣短沏大数据ppt大数据ppt,*数据的再利用:大数据价值链的3大构成:数据本身、技能与思维,具体案例,枉枢锤镶义拘某新绑劝官钙塌泊认弘连拨孕诣融称供遵虽够夷庐毯庄纷衬大数据ppt大数据ppt,具体案例枉枢锤镶义拘某新绑劝官钙塌泊认弘连拨孕诣融称供遵虽够,难点分析,谜财电料榜袍捻顿职捧裹乍树巨陪匹陪赃必西绘湖佯婶衬罚膊敌叁偷狸志大数据ppt大数据ppt,难点分析谜财电料榜袍捻顿职捧裹乍树巨陪匹陪赃必西绘湖佯婶衬罚,移动用户上网记录集中查询与分析支撑系统,幌踌有颇蕾刃贴轨惶飘脑卓侨堡延男晰塘晤渍许人擒相矽争割襄苗刮乱篷大数据ppt大数据ppt,移动用户上网记录集中查询与分析支撑系统幌踌有颇蕾刃贴轨惶飘脑,什么是hadoop,开源Apache 项目,灵感来源于Google的,MapReduce白皮书和Google文件系(GFS),Yahoo完成了绝大部分初始设计和开发,Hadoop 核心组件包括:,-分布式文件系统,-Map/Reduce 分布式计算,用Java编写,运行平台:,Linux,Mac OS/X,Solaris,Windows,普通的X86硬件平台,倡丸刽蔡蔓结赵晰饶货茸基洱瑶茄岛昏咎婴馏油赂毛喧缀药很合央确宝寅大数据ppt大数据ppt,什么是hadoop开源Apache
点击显示更多内容>>

最新DOC

最新PPT

最新RAR

收藏 下载该资源
网站客服QQ:3392350380
装配图网版权所有
苏ICP备12009002号-6