大数据应用的方案.doc

上传人:qingbi****02000 文档编号:127743968 上传时间:2020-04-05 格式:DOC 页数:38 大小:1.94MB
返回 下载 相关 举报
大数据应用的方案.doc_第1页
第1页 / 共38页
大数据应用的方案.doc_第2页
第2页 / 共38页
大数据应用的方案.doc_第3页
第3页 / 共38页
大数据应用的方案.doc_第4页
第4页 / 共38页
大数据应用的方案.doc_第5页
第5页 / 共38页
点击查看更多>>
资源描述

《大数据应用的方案.doc》由会员分享,可在线阅读,更多相关《大数据应用的方案.doc(38页珍藏版)》请在金锄头文库上搜索。

1、 大数据应用解决方案目 录1.大数据概述61.1.概述61.2.大数据定义61.3.大数据技术发展82.大数据应用112.1.大数据应用阐述112.2.大数据应用架构132.3.大数据行业应用132.3.1.医疗行业132.3.2.能源行业142.3.3.通信行业142.3.4.零售业153.大数据解决方案163.1.大数据技术组成163.1.1.分析技术163.1.1.1.可视化分析163.1.1.2.数据挖掘算法163.1.1.3.预测分析能力163.1.1.4.语义引擎163.1.1.5.数据质量和数据管理173.1.2.存储数据库173.1.3.分布式计算技术183.2.大数据处理过程

2、203.2.1.采集203.2.2.导入/预处理213.2.3.统计/分析213.2.4.挖掘213.3.大数据处理的核心技术-Hadoop213.3.1.Hadoop的组成223.3.2.Hadoop的优点:253.3.2.1.高可靠性。253.3.2.2.高扩展性。253.3.2.3.高效性。253.3.2.4.高容错性。253.3.3.Hadoop的不足253.3.4.主要商业性“大数据”处理方案263.3.2.5.IBM InfoSphere大数据分析平台263.3.2.6.Or a c l e Bi g Da t aApplianc273.3.2.7.Mi c r o s o f t

3、 S QLServer273.3.2.8.Sybase IQ283.3.5.其他“大数据”解决方案283.3.2.9.EMC283.3.2.10.BigQuery293.3.6.大数据”与科技文献信息处理293.4.大数据处理技术发展前景293.4.1.大数据复杂度降低293.4.2.大数据细分市场303.4.3.大数据开源303.4.4.Hadoop将加速发展303.4.5.打包的大数据行业分析应用303.4.6.大数据分析的革命性方法出现313.4.7.大数据与云计算:深度融合313.4.8.大数据一体机陆续发布314.基于基站大数据应用及案例324.1.气象灾害应急短信发布平台324.1

4、.1.概述324.1.1.1.项目背景324.1.1.2.平台概述324.1.2.平台建设特点与原则324.1.2.1.建设特点324.1.2.2.建设原则324.1.2.3.大数据管理平台特点334.1.3.平台整体架构334.1.3.1.建设原理334.1.3.2.平台总体设计351.平台总体结构352.平台技术架构364.1.3.3.平台技术思路374.1.3.4.平台技术路线381.内存数据库382.短信发送多链路配置383.队列缓存384.参数可配置384.1.3.5.平台性能要求384.1.4.平台网络拓扑384.1.5.平台关键流程394.1.5.1.平台数据流程394.1.5.

5、2.平台业务主流程404.1.5.3.短信下发审批流程414.1.5.4.信令分析处理流程424.1.5.5.短信发送流程434.1.6.平台功能模块434.1.6.1.信令分析子系统434.1.6.2.短信发送子系统441.短信发送功能442.短信回执接收功能443.短信批量发送管理功能454.统计报表454.1.6.3.管理子系统451.用户管理452.权限管理463.实时监控464.日志管理465.基站位置信息管理466.系统参数配置管理464.1.6.4.内容数据库子系统464.1.7.平台外部接口474.1.7.1.信令采集接口471.接口说明472.数据采集模式474.1.7.2.

6、短信发送接口471.短信发送通知接口472.短信发送状态查询接口473.短信发送接口474.1.7.3.基站位置信息接口481.数据同步模式482.基站位置信息全量同步接口483.基站位置信息增量同步接口484.2.旅游客源分析484.2.1.建设目标484.2.2.整体方案494.2.2.1.方案思路494.2.2.2.分析范围494.2.2.3.方案特点504.2.3.方案设计514.2.3.1.系统关系514.2.3.2.系统架构511.数据分析后台能力522.Web前台能力524.2.3.3.数据采集534.2.3.4.业务分析531.总体分析流程532.景区综合流量统计分析543.景

7、区游客来源地构成分析554.景区全网总游客实时估算575.景区流量预判模型分析586.景区流量上限告警597.旅游景点热度排名分析598.旅游线路归类统计609.景区与相关场所关联分析614.2.3.5.界面功能介绍611.菜单功能列表622.界面辅助功能介绍633.运营部门应用Portal644.用户权限641. 大数据概述1.1. 概述大数据,IT行业的又一次技术变革,大数据的浪潮汹涌而至,对国家治理、企业决策和个人生活都在产生深远的影响,并将成为云计算、物联网之后信息技术产业领域又一重大创新变革。未来的十年将是一个“大数据”引领的智慧科技的时代、随着社交网络的逐渐成熟,移动带宽迅速提升、

8、云计算、物联网应用更加丰富、更多的传感设备、移动终端接入到网络,由此而产生的数据及增长速度将比历史上的任何时期都要多、都要快。数据技术发展历史如图一所示:图一1.2. 大数据定义“大数据”是一个涵盖多种技术的概念,简单地说,是指无法在一定时间内用常规软件工具对其内容进行抓取、管理和处理的数据集合。IBM将“大数据”理念定义为4个V,即大量化(Volume)、多样化(Variety)、快速化(Velocity)及由此产生的价值(Value)。如图二;图二要理解大数据这一概念,首先要从大入手,大是指数据规模,大数据一般指在10TB(1TB=1024GB)规模以上的数据量。大数据同过去的海量数据有所

9、区别,其基本特征可以用4个V来总结(Vol-ume、Variety、Value和Veloc-ity),即体量大、多样性、价值密度低、速度快。 数据体量巨大。从TB级别,跃升到PB级别。 数据类型繁多,如前文提到的网络日志、视频、图片、地理位置信息,等等。 价值密度低。以视频为例,连续不间断监控过程中,可能有用的数据仅仅有一两秒。 处理速度快。1秒定律。最后这一点也是和传统的数据挖掘技术有着本质的不同。物联网、云计算、移动互联网、车联网、手机、平板电脑、PC以及遍布地球各个角落的各种各样的传感器,无一不是数据来源或者承载的方式。大数据技术是指从各种各样类型的巨量数据中,快速获得有价值信息的技术。

10、解决大数据问题的核心是大数据技术。目前所说的大数据不仅指数据本身的规模,也包括采集数据的工具、平台和数据分析系统。大数据研发目的是发展大数据技术并将其应用到相关领域,通过解决巨量数据处理问题促进其突破性发展。因此,大数据时代带来的挑战不仅体现在如何处理巨量数据从中获取有价值的信息,也体现在如何加强大数据技术研发,抢占时代发展的前沿。1.3. 大数据技术发展大数据技术描述了一种新一代技术和构架,用于以很经济的方式、以高速的捕获、发现和分析技术,从各种超大规模的数据中提取价值,而且未来急剧增长的数据迫切需要寻求新的处理技术手段。如图三所示:图三在“大数据”(Big data)时代,通过互联网、社交

11、网络、物联网,人们能够及时全面地获得大信息。同时,信息自身存在形式的变化与演进,也使得作为信息载体的数据以远超人们想象的速度迅速膨胀。云时代的到来使得数据创造的主体由企业逐渐转向个体,而个体所产生的绝大部分数据为图片、文档、视频等非结构化数据。信息化技术的普及使得企业更多的办公流程通过网络得以实现,由此产生的数据也以非结构化数据为主。预计到2012年,非结构化数据将达到互联网整个数据量的75%以上。用于提取智慧的“大数据”,往往是这些非结构化数据。传统的数据仓库系统、BI、链路挖掘等应用对数据处理的时间要求往往以小时或天为单位。但“大数据”应用突出强调数据处理的实时性。在线个性化推荐、股票交易

12、处理、实时路况信息等数据处理时间要求在分钟甚至秒级。全球技术研究和咨询公司Gartner将“大数据”技术列入2012年对众多公司和组织机构具有战略意义的十大技术与趋势之一,而其他领域的研究,如云计算、下一代分析、内存计算等也都与“大数据”的研究相辅相成。Gartner在其新兴技术成熟度曲线中将“大数据”技术视为转型技术,这意味着“大数据”技术将在未来35年内进入主流。而 “大数据”的多样性决定了数据采集来源的复杂性,从智能传感器到社交网络数据,从声音图片到在线交易数据,可能性是无穷无尽的。选择正确的数据来源并进行交叉分析可以为企业创造最显著的利益。随着数据源的爆发式增长,数据的多样性成为“大数

13、据”应用亟待解决的问题。例如如何实时地及通过各种数据库管理系统来安全地访问数据,如何通过优化存储策略,评估当前的数据存储技术并改进、加强数据存储能力,最大限度地利用现有的存储投资。从某种意义上说,数据将成为企业的核心资产。“大数据”不仅是一场技术变革,更是一场商业模式变革。在“大数据”概念提出之前,尽管互联网为传统企业提供了一个新的销售渠道,但总体来看,二者平行发展,鲜有交集。我们可以看到,无论是Google通过分析用户个人信息,根据用户偏好提供精准广告,还是Facebook将用户的线下社会关系迁移在线上,构造一个半真实的实名帝国,但这些商业和消费模式仍不能脱离互联网,传统企业仍无法嫁接到互联

14、网中。同时,传统企业通过传统的用户分析工具却很难获得大范围用户的真实需求。企业从大规模制造过渡到大规模定制,必须掌握用户的需求特点。在互联网时代,这些需求特征往往是在用户不经意的行为中透露出来的。通过对信息进行关联、参照、聚类、分类等方法分析,才能得到答案。“大数据”在互联网与传统企业间建立一个交集。它推动互联网企业融合进传统企业的供应链,并在传统企业种下互联网基因。传统企业与互联网企业的结合,网民和消费者的融合,必将引发消费模式、制造模式、管理模式的巨大变革。大数据正成为IT行业全新的制高点,各企业和组织纷纷助推大数据的发展,相关技术呈现百花齐放局面,并在互联网应用领域崭露头角,具体情况如下图四所示:图四大数据将带来巨大的技术和商业机遇,大数据分析挖掘和利用将为企业带来巨大的商业价值,而随着应用数据规模急剧增加,传统计算面临严重挑战,大规模数据处理和行业应用需求日益增加和迫切

展开阅读全文
相关资源
相关搜索

当前位置:首页 > 商业/管理/HR > 公司方案

电脑版 |金锄头文库版权所有
经营许可证:蜀ICP备13022795号 | 川公网安备 51140202000112号