ImageVerifierCode 换一换
格式:DOCX , 页数:23 ,大小:429.23KB ,
资源ID:23799220      下载积分:3 金币
快捷下载
登录下载
邮箱/手机:
温馨提示:
快捷下载时,用户名和密码都是您填写的邮箱或者手机号,方便查询和重复下载(系统自动生成)。 如填写123,账号就是123,密码也是123。
特别说明:
请自助下载,系统不会自动发送文件的哦; 如果您已付费,想二次下载,请登录后访问:我的下载记录
支付方式: 支付宝    微信支付   
验证码:   换一换

加入VIP,免费下载
 

温馨提示:由于个人手机设置不同,如果发现不能下载,请复制以下地址【https://www.bdocx.com/down/23799220.html】到电脑端继续下载(重复下载不扣费)。

已注册用户请登录:
账号:
密码:
验证码:   换一换
  忘记密码?
三方登录: 微信登录   QQ登录  

下载须知

1: 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。
2: 试题试卷类文档,如果标题没有明确说明有答案则都视为没有答案,请知晓。
3: 文件的所有权益归上传用户所有。
4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
5. 本站仅提供交流平台,并不能对任何下载内容负责。
6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

版权提示 | 免责声明

本文(大数据即服务DaaS以及大大数据.docx)为本站会员(b****7)主动上传,冰豆网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知冰豆网(发送邮件至service@bdocx.com或直接QQ联系客服),我们立即给予删除!

大数据即服务DaaS以及大大数据.docx

1、大数据即服务DaaS以及大大数据大数据技术开展态势跟踪 关于大数据的几个重要观点和产业技术路线开展2014-8-14 11:50:31:科技开展研究杂志大数据Big Data,普遍认为是指在特定行业中,超出常规处理能力、实时生成、类型多样化的数据集合体,具有海量Volume、快速Velocity、多样Variety和价值Value的4V 特征。最早提出大数据特征的是2001 年麦塔集团后被Gartner 公司收购分析师道格莱尼Douglas Laney发布的3D 数据管理:控制数据容量、处理速度与数据种类3D Data Management: ControllingData Volume, V

2、elocity and Variety,提出了4V 特征中的3V。最早提出词汇“Big Data的是2011 年麦肯锡全球研究院发布的大数据:下一个创新、竞争和生产力的前沿研究报告。之后,经Gartner 技术炒作曲线和2012 年维克托舍恩伯格大数据时代:生活、工作与思维的大变革的宣传推广,大数据概念开始风靡全球。一、关于大数据的几个重要观点大数据开展至今,伴随着很多争议。有人称之为“新瓶装旧酒,也有人认为大数据的机遇被过于夸大,企业就是在这种怀疑和忐忑中抓紧推进大数据应用。客观上看,大数据在研究X式、企业战略层面具有变革的潜力,但不宜过于强调其新颖性,不应同过去的数据学科领域割裂开来;21

3、 世纪以来,大数据技术发生了革命性突破,主要表现在对3V 特性的“适应和“运用上,目前受益最大的是云计算产业,对其他产业和社会开展的变革作用尚未落地。有如下几个重要判断和观点:1、大数据的核心思想本质是数据挖掘。数据挖掘Data Mining借助计算机从海量数据中发现隐含的知识和规律,是一门融合了计算机、统计等领域知识的交叉学科,其核心的人工智能、机器学习、模式识别等理论在上世纪90 时代推行知识管理时已有显著进展。从本质上看,大数据带来的“思维大变革以与一些数据驱动类的商业智能Business Intelligence模式创新,都是数据挖掘理论的延伸,表达为“数据挖掘相对于数理统计带来的思维

4、变革或许更加准确。比如,因果关系是数理统计中的重要内容,基于完善的数学理论,代表是回归模型;而相关关系是数据挖掘中的重要内容,基于强大的机器运算能力,代表是神经网络、决策树算法,这使得人们不需要了解背后复杂的因果逻辑也可以获得良好的分析和预测结果。从某种程度上说,必须感谢大数据的宣传者,正是这样的热炒才让数据挖掘这样一门小众却极具价值的科学展现在大众眼前,起到了很好的科普作用。2、突破主要来自技术上的“能力拓展。表现在对多样Variety、海量Volume、快速Velocity特征的“适应和“运用上:一是存储数据从结构化向半结构化、非结构化拓展,如基于Web 异构环境下的网页、文档、报表、多媒

5、体等,导致了一批基于非结构化数据的专有挖掘算法的产生和开展。二是数据库从关系型向非关系型、分布式拓展,关系型数据库是以行和列的形式组织起来的结构化数据表,如Excel 表格,缺点在于存储容量小、数据扩展性和多样性差,而新的非关系型、分布式数据库可以弥补上述不足。三是数据处理从静态向实时交互拓展,新的大规模分布式并行数据处理技术能够实时处理社交媒体和物联网应用产生的大量交互数据,有效应对多样Variety和海量Volume带来的复杂度和时效性要求。3、能力拓展直接促成了价值Value的实现。得益于上述技术,数据挖掘理论获得了呈几何倍数增长的数据量和处理能力,原本很多无法验证的设想和方法得以实现。

6、比如,传统BI 分析有一个“集中步骤,即在分析前需要对大量数据抽取和集中化,形成一个完整的数据仓库,这个步骤往往成为BI 分析全过程的能力瓶颈;而基于大数据分布式技术的BI 分析无需“集中,大大提升了敏捷度和智能水平,从而推动机器学习、语义处理等领域发生重大突破,直接促成了Mahout 机器学习算法集、Siri 语音助手等一批商用化产品的问世。4、变革的潜力主要表现在数据开放战略和数据驱动X式上。在战略层面,数据处理从封闭、断点、静态向开放、海量、实时的转变,引发了社区、众包、网格等新业态、新模式蓬勃开展,在此根底上将推动机构数据开放和公众共享运动的兴起。在研究X式层面,科学研究出现从推理演绎

7、驱动向数据驱动拓展的苗头,如生物基因与健康等研发密集型产业开始向数据研究科学拓展;许多传统的科学研究如历史、文学等也开始尝试运用数据分析技术。但上述重大变革目前尚未真正实现。大数据现有技术水平的主要受益产业仍然是云计算和各类基于云计算的商业模式,在信息根底设施普与率、社会开放性以与与网络智能交互技术的结合度没有达到一定能级时,大数据的应用是有限的,达不到面向社会的“无所不能。5、大数据技术的主要推动者是互联网企业。由于更多地围绕云计算,所以大数据的底层架构和核心技术主要由谷歌、亚马逊、脸谱以与美国Apache 基金会等互联网企业机构掌握。谷歌公司研发了大数据“三核心文件系统GoogleFile

8、System 、处理算法MapReduce和分布式数据库BigTable,打造了全球大数据开发的主流框架和X式。雅虎和Apache 基金会基于谷歌的算法思想,开发了Hadoop 开源框架,向广阔企业和创业者开放,推动产业生态系统的不断壮大;亚马逊、脸谱、推特等企业在此框架根底上开发各类功能性工具;而微软、IBM 等传统IT 企业在产业链上更多关注下游应用,开发产品和系统解决方案。6、大数据的提出有助于进一步明晰云计算的概念。从专有领域的角度看,原来的云计算包括两层概念:一类是海量数据的高效处理,主要是大规模分布式并行运算技术,代表是谷歌公司;另一类是硬件资源的虚拟化分配,更多聚焦虚拟机技术和对

9、象存储出租商业模式,代表是亚马逊公司。这两层概念相互交织,往往让外界分不清楚。大数据概念的提出,可以将前者完全涵盖,侧重微观、技术和前端;云计算这个概念今后可更多地在商业模式层面进展定义,侧重宏观、服务和后端。任何IT 企业的云战略都可以分成两条线:一个是大数据,一个是云计算,分别对应不同的产品。比如微软公司,如果说的是其并行数据仓库与Hadoop 集成的解决方案,那么谈论的是大数据;如果提到的是其Azure 数据库服务租用平台和IaaS、PaaS、SaaS 三类服务模式,那么谈论的是云计算。7、数据并非越大越有价值。大数据支持者的一个重要论断是:基于全量,大数据分析的准确性将超越传统数理统计

10、,因果关系将为相关关系所取代,而事实并非如此乐观。一方面,传统的数理统计没有过时。其经历四百年的开展,仍然在经济社会各方面发挥着重要作用。比如,抽样是一门古老且成熟的统计方法,如果目标明确、方法科学,其在绝大多数情况下得出结论的正确性,并不逊于全量数据。客观上看,全量的价值更多表现在一些传统数理统计根本假设可能失效之处,如互联网“长尾现象的出现,导致正态分布、帕累托法如此在个别领域不再适用,此时需要依靠全量数据寻求规律。另一方面,全量伴生的“噪音有时会影响精准度。例如,被誉为大数据杰出案例的“谷歌流感趋势近期陷入低谷,错误率高达90%以上108 周中错了100 周,不能预测甲型H1N1 等重大

11、疫情。它的核心逻辑是:搜索“流感的人数与实际患症的人数之间存在相关性,而事实上,即便去医院看流感的人都有80%90%实际没有得流感,外表的网络搜索行为与可靠的信息来源还存在较大差距以与“去噪过程。很多专家认为,就目前而言,相关关系还不足以替代因果关系,而只是作为其补充。二、大数据技术开展经历了从萌芽到成熟的过程基于Web of Science 数据库1中1994 年后涉与大数据概念的4495篇文献,采用Citespace 知识图谱工具,通过热点关键词和高被引文献分析,勾勒出了大数据技术从萌芽到成熟的开展历程如图1、2。1、萌芽期:数据挖掘技术上世纪90 年代-本世纪初随着数据挖掘理论和数据库技

12、术的逐步成熟,一批商业智能工具和知识管理技术开始被应用,如数据仓库、专家系统、知识管理系统等。此时,对于大数据的研究主要集中于“Algorithms算法、“Model模型、“Patterns模式、“Identification识别等热点关键词,高被引文献侧重于数据挖掘和机器学习的根底技术,如1993 年Quinlan JR 发明的C4.5 数据挖掘算法,1995 年VladimirN.Vapnik 撰写的机器学习教材,以与1998 年Eisen MB 等关于聚类分析和全基因组表达模式的研究等。2、突破期:围绕非结构化数据自由探索2003-2006 年非结构化数据的爆发带动大数据技术的快速突破。

13、以 2004 年Facebook 创立为标志,社交网络的流行直接导致大量非结构化数据的涌现,而传统处理方法难以应对。此时的热点关键词较为分散,包括了“Systems系统、“Networks网络、“Evolution演化等,高被引文献也很少,说明学术界、企业界正从多角度对数据处理系统、数据库架构进展重新思考,且尚未形成共识。期间,谷歌公司Jeff Dean 和Sanjay Ghemawat 发表了三篇论文,分别提出GoogleFileSystem2003、MapReduce 算法2004和BigTable 数据库2006,奠定了大数据技术的核心根底。3、成熟期:形成并行运算与分布式系统2006-

14、2009 年Jeff Dean 在BigTable 根底上开发了Spanner 数据库2009。此阶段,大数据研究的热点关键词再次趋于集中,聚焦“Performance性能、“Cloudputing云计算、“MapReduce大规模数据集并行运算算法、“Hadoop开源分布式系统根底架构等。在高被引文献方面,有两篇引人注目,分别是2008 年谷歌公司正式发表的MapReduce 论文和2009 年Tom White 发表的Hadoop 论文。4、未来:大数据技术仍在快速开展2010 年至今随着智能手机的应用日益广泛,数据的碎片化、分布式、流媒体特征更加明显,移动数据急剧增长。老“三核心面临能力

15、瓶颈,而2010 年谷歌为应对这种趋势而开发的Percolator、Dremel 和Pregel 日趋成为新“三核心。与此同时,非关系型数据库NoSQL再次自我革新,开始转向兼具关系型易查询和非关系型高扩展性的新型云数据库NewSQL,代表如谷歌的Spanner、亚马逊的RDS、微软的SQL Azure 等,大数据的核心技术仍在快速开展。 全球大数据研究的进展、分布和前沿二十年来,全球大数据研究经历了一个从起步到活跃的过程。基于大数据相关的4573 篇文献和8571 项专利,对其研究进展、分布和前沿进展分析,可以得出如下结论:1、美国是大数据研究的中心地带,技术创新活跃,国际间合作频繁。2、我

16、国对大数据研究的资助力度较大,学术论文较多,但与国外创新合作较少。3、系统、性能和算法是大数据研究的重点方向和核心根底。4、大数据产业创新不仅聚焦软件技术研发,还在硬件技术上重点布局。一、大数据研究文献的国别和机构分布1、美国是大数据研究的中心地带,我国紧随其后。美国是研究者最多的国家,约占总数的34%,中国紧随其后,占23%,美中两国合计占到总数的一半以上。其余的前10 位国家包括:德国、英国、日本、印度、加拿大、法国、澳大利亚和韩国。2、大数据研究文献开展的“三阶段特征显著。第一阶段是1994-2001 年,年均文献不超过50 篇,研究文献主要为“美国籍。第二阶段为2002-2010 年,

17、年均文献超过100 篇,且以年均20%的幅度稳步增长,突出特点是我国文献开始出现,并在2008-2009 年超过了美国。第三阶段为2011-2013 年,研究文献出现爆发式增长,3 年文献共达到2053 篇,占20 年累计总数的44.9%;主要原因是美国文献的再次崛起,3 年内贡献了735 篇,而我国为489 篇。3、我国政府对大数据研究的资助力度较大。文献数前25 位的研究机构中,美国16 所大学上榜,共发表论文559 篇,占美国文献总数的36.4%。中国如此有6 所大学机构上榜,其中中科院发表论文数居世界第一,达到109 篇,之后依次是清华大学、某某交通大学、某某工业大学、某某大学和华中科

18、技大学。6 所大学机构共计发表论文244 篇,约占我国大数据文献总数的四分之一。从资助机构上看,资助5 篇以上的机构一共有36 家,大多为国家基金组织和政府部门。其中,中国国家自然科学基金、美国国家科学基金和国立卫生研究院是三家资助发表文献最多的机构,分别达到122 篇、109 篇和57 篇。而企业更多聚焦专利领域进展布局,仅有谷歌和微软两家公司资助的研究文献超过5 篇。4、我国大数据研究的质量有待进一步提升。一方面,从合作关系上看,我国的大数据研究与世界联系不多,仅与某某地区、德国有少量合作,而美国与韩国、澳大利亚、法国、瑞典、瑞士、土耳其等国家保持着密切的合作关系,德国、加拿大、英国之间也

19、有不少合作。另一方面,从文献被引频次来看,研究文献的质量低于美国,美国1537 篇论文平均引用次数达到14.20 次,高引用指数为66,而我国文献的高引用指数仅有20。二、大数据研究的学科领域分布1、大数据研究开始渗透进入应用领域。文献涉与的学科领域超过100 个。在排名前15 位的学科领域中图5,除了数学、物理学等根底学科外,更是出现了微生物学、环境生态学、运筹学与管理科学等应用学科,说明大数据技术已经渗透进入各个根底和应用学科领域。2、系统、性能和算法是大数据研究的重点方向。从大数据涉与的主要学科领域分布中可以看到,大量文献集中在数据处理的系统、性能和算法上,如数据挖掘、机器学习、主成分分

20、析与分类等方向位于核心层,其次为神经网络、降维运算、数据存储、关联规如此、数据集等。3、核心根底技术文献被大量引用。以谷歌公司的Mapreduce 为例,作为大数据的根底技术,该文献后续被近700 篇论文所引用,切实推动了分布式计算、Hadoop 等热点研究的开展。三、大数据产业技术创新的重点方向与学术文献研究不同的是,从企业专利布局角度出发,更有利于分析大数据产业技术创新的重点方向。为此,基于Orbit 专利数据库和VOSviewer 软件,对14 家国际性的IT 企业、互联网企业以与新兴大数据企业自2006 年以来的8571 项专利进展分析:1、大数据软件技术已趋于体系化。在数据的根本框架

21、、采集传输、存储、处理分析等各个环节上,都有不同于以往抽样、封闭、小规模条件的新技术予以支撑,大数据软件技术体系逐步趋于完整。在此根底上,传统的IT 企业、互联网企业纷纷开发了基于大数据的行业解决方案和商业应用平台,一批新兴大数据企业加快开展并进展商业模式创新,产业创新生态系统所需的各项条件日趋完备。2、企业在大数据硬件技术上的布局不亚于软件。与学术研究侧重于软件技术不同,企业十分重视相关硬件设备的技术布局。一方面,按照国际专利进展分类,数据处理、存储和相关设备依然是专利较为集中的领域,如大数据专利数量较多的G06F-017、G06F-015、G06F-007、G06F-003、G06F-00

22、9、G06F-021 等分类号,均侧重于计算机数据的处理、存储、控制、接口、安全等硬件电路、设备和零部件。另一方面,8571 项专利集聚形成几个较大的专利群,包括采集显示和传输、处理分析、记录存储、数据管理、共享与协作等,其中规模最大的专利群,依然是与采集、显示和传输相关的外围信息硬件设备。值得一提的是,14 家国际性企业大数据技术专利的一局部贡献来自于其在华分公司。8571 项专利中,公开国为中国的有1757 项,优先权国在中国的有170 项,说明了我国研究人员在大数据领域研究水平的不断提升。产业链格局、竞争策略与商业模式当前,全球大数据产业正处于蓬勃开展的孕育期和机遇期。核心关键技术也在加

23、快开展和更新换代,各类解决方案提供商加大力度宣传造势,尤其是围绕电信、航空、交通、生物、城市管理等重点领域描绘美好蓝图,力求推动行业应用和商业模式创新,抢占产业增长点;与此同时,小微企业和创业者对大数据热情高涨,期望借此机会实现高速成长的梦想。简言之,由于整个产业开始转向应用创新阶段,高成长的预期让各方都对未来抱以乐观的态度。一、大数据产业从“技术驱动转向“应用驱动大数据产业的“技术驱动色彩十清楚显,与“应用驱动阶段尚有一定差距,但这一转变过程正在加速进展。1、“两纵三横的产业体系趋于成熟。作为一个独立的产业来看,大数据的产业体系框架表现为“两纵三横:“两纵基于技术的根底程度,分为底层技术和应

24、用层技术,前者是共性、根底性技术,如Hadoop 框架、Hbase 数据库、Mahout 算法集等;后者是“二次开发行为,包括各类个性化方案、产品与服务。而“三横基于处理的流程顺序,分为根底设施、分析系统和应用工具,也可进一步细化为数据的采集、存储、处理、分析、服务五方面。这一框架体系已经趋于成熟,能够应对绝大多数的产业应用需求。彭博创投Bloomberg Ventures在2012 年对大数据产业进展了调研,也曾将大数据领域的企业和产品分为三类:根底设施、分析和大数据开源技术大数据根底设施大数据分析系统 大数据应用工具分析根底设施操作根底设施根底设施即服务IaaS数据库分析解决方案可视化数据

25、即服务DaaS商业智能BI垂直产业应用日志应用广告/媒体应用采集、存储、处理、分析、服务应用,这种划分方法对应了大数据的产业体系框架,根本覆盖了数据处理技术的全链条、各环节。2、产业开展的方向大都与大数据关联。广义的大数据应用本质上是一种“增值分析,前景有着近似无限的可能,不受任何行业、资源、地域、用户的约束。从此角度上讲,产业的未来开展方向几乎都能和大数据挂钩。以“十二五国家战略性新兴产业开展规划为例,很多技术前沿的描述和布局,均与大数据相一致或关联,或是可以通过大数据实现。如新一代信息技术产业布局了物联网、移动终端设备、云计算、海量数据处理软件;节能环保产业布局了高效储能、节能监测和能源计

26、量;生物医药产业布局了生物资源样本库、基因测序、以与基于物联网的远程健康管理服务等。3、技术的开源特点加速了应用转化过程。大数据技术兴起于互联网时代,而互联网企业大都持有共享开放的价值观,不偏好也不需要依靠垄断有限资源生存,这导致大数据技术早在萌芽阶段就是开源技术,无偿供应全世界的开发者使用;后续包括Hadoop 等底层技术均为开源性质,也没有任何专利门槛。这种免费、去专利化的特点催生了开源项目、开源社区、开放性创新联盟组织的兴起,有效降低了产业技术的壁垒,推动更多的企业和创业者介入,进一步加快了技术应用转化的过程,有助于产业的迅速成长。二、产业竞争策略逐步成型大数据产业是典型的知识密集型服务

27、业,除了根底设施环节会带来一定能耗之外,其余环节均为零能耗、高附加值。其在初始资本、法规监管等方面的准入门槛极低,但对人才资源的要求较高。为此,产业竞争呈现出数量大、水平高的特点,企业竞争策略逐步分化。1、竞争者虽多,却未形成过度竞争。大数据从业者正在急剧增加,几乎所有的信息技术企业都在此领域布局,同时创业者持续不断地进入此领域。然而,由此带来的并非是过度竞争,而是良性竞争,最终将推动技术的创新和价值的实现。这主要归功于两个原因:一是高创新的属性。大数据技术是ICT 领域中的高附加值环节,以谷歌、亚马逊等为代表的大数据企业,无论是在技术先进性、创新活跃度还是在市场份额上,都在全球处于领先位置。

28、二是高增长的预期。作为企业个体,在产业急速成长的预期之下,根本都选择了追求专业性的策略,依靠产品性能和服务取胜,而摈弃了追求低本钱的策略。2、三类竞争者各具优势。按照技术的变革性与应用水平,主要分化为三类竞争者:一是“互联网颠覆者,谷歌、亚马逊、Apache基金会开发了全新的根底技术与数据库构架,依靠免费、开源的所谓互联网模式,彻底改变了原有的技术标准与游戏规如此,颠覆了ICT 产业。二是“初生牛犊,在新的规如此面前,大公司与创业者处在同一条起跑线上,一些拥有核心人才与市场嗅觉的创业企业,如SPLUNK、Cloudera、Evernote 等企业,在特定工具、专业平台方面迅速抢占先机,填补市场

29、空白,获得快速开展,在产业链中拥有了一席之地。三是“系统集成商,微软、IBM、HP、Oracle、EMC2、SAP,这些传统IT 巨头拥有强大的资金、研发能力和市场资源。面临大数据的冲击,他们能够敏锐意识到自我革命的紧迫性,并且马上采取应对举措。他们的策略更多是防御性和商业化的,即依靠已有客户资源、成熟的产品线、丰富的行业经验加上商业并购予以应对。在技术布局方面,大数据的竞争策略分为两类:一是做细分市场专业产品,主要是“互联网颠覆者和“初生牛犊,专注于技术领域的耕耘,大量的不同创新产品与应用层出不穷,形成了大数据的技术创新生态。二是整合资源,主要是“系统集成商,依靠并购“初生牛犊企业,整合各类

30、资源,将大量专业技术产品组装为面向行业的应用解决方案。如IBM 在7 年内2006-2013 年并购了30 多家公司,均指向数据库、存储、商务智能、非结构化分析工具等,IBM还计划2015 年前再支出145 亿美元用于大数据并购。3、政府是大数据产业的重要一环。与金融、化工、医药等行业相比,大数据并不是一个需要政府强力监管的行业。目前,各国也只有在网络安全与隐私保护方面出台了相关监管法案。与此相反,政府将在促进产业开展上扮演更加重要的角色,主要表现在公共数据的开放上。2009 年,美国总统奥巴马签署了首份总统备忘录透明和开放的政治,成立了统一的政府数据开放门户:Data.Gov,全面开放政府拥

31、有的公共数据,提供多种应用程序接口,供开发者创建特色应用。这一开放式平台极大地刺激了数据驱动型创新,截至2014年初,该开放的数据集已经超过了85000 项,聚集了1200 余个应用程序和软件工具、手机插件,其中超过300 个是由个人或民间组织开发,新的商业模式和企业随之产生,如FlightCaster 公司基于美国交通统计局、联邦航空局交通管制中心警报、美国气象局和航班运行状况信息FlightStats 的数据,提供航班晚点预报,比航空公司的正式通知早6 个小时,且准确率达到85%-90%。三、大数据的商业模式创新数据驱动型的商业模式有如雨后春笋,在全球加快涌现。为对应产业体系框架,进一步明

32、确价值流向,本文按照数据的获取、管理、分析、应用环节的区分方式,将大数据的商业模式分为数据托管和交易平台、关系挖掘和沉淀价值利用、数据社交和跨界连接三种类型。1、数据托管和交易平台模式该模式应用已有数十年之久,是开展最为成熟、最为普遍的大数据商业模式,本质是发挥规模效应,降低单个企业在数据信息存储和寻找上的投入本钱。主要业务形态有空间出租托管、数据商店、数据市场等,典型的代表企业为亚马逊、EMC2、DropBox。近年来,该模式引入“云的概念,从简单的数据存储,逐步扩展到数据聚合平台,最终形成云服务;而以独特数据资源进展的整合朝着纵向产业链上下游整合和横向多种产业整合两个方向开展,促使了一站式数据商店和数据交易平台的出现。如亚马逊、微软等企业均建立了可以交易应用程序和高级数据集的数据商店,目前已有数万亿个数据点、数千个订阅、数百个应用程序。2、关系挖掘和沉淀价值利用模式关系挖掘是媒体热炒的主流大数据商业模式,也是数

copyright@ 2008-2022 冰豆网网站版权所有

经营许可证编号:鄂ICP备2022015515号-1