申请专栏作者
您的当前位置:主页 > yabo亚博体育下载 > 正文

大yabo88滚球分析的八大趋势

来源: 时间:2019-07-31
请点击下面的广告后浏览!
  大yabo88滚球相信大家已经不陌生了,Intuityabo88滚球工程副主管Loconzolo双脚都已经迈进yabo88滚球湖里了。Smarter Remarketer首席yabo88滚球科学家DeanAbbott也为云技术的发展指出了捷径。他们二人一致认为, 大yabo88滚球与分析学前沿是个活动目标,这一领域包含了储存原始yabo88滚球的yabo88滚球湖和云计算。尽管这些技术并未成熟,但等待也并非上策。
\
  Loconzolo表示:“现实的情况是,这些工具都刚刚兴起,他们构筑的平台还不足以让企业依赖。但是,大yabo88滚球和分析学等学科发展十分迅速,因此企业必须努力跟上,否则就有被甩掉的危险。”他还说:“过去,新兴技术往往需要十年左右的时间才能够成熟,但是现在大大不同了,人们几个月甚至几周时间就能想出解决方案。”那么,有哪些新兴技术是我们应该关注,或者说科研人员正在重点研究的呢?《电脑世界》采访了一些IT精英、咨询师和行业分析专家,来看看他们列出的几大趋势吧。
?
  1.大yabo88滚球湖泊
?
  美国普华永道首席技术专家Chris Curran说,传统yabo88滚球库理论认为,人们应该先设计yabo88滚球集,然后再将yabo88滚球输入进去。而“yabo88滚球湖泊“,也被称作“企业yabo88滚球湖泊”或者“企业yabo88滚球中心”,颠覆了这个理念。“现在,我们先收集yabo88滚球,然后把它们都存入Hadoop仓库里,我们不必事先设计yabo88滚球模型了。”这个yabo88滚球湖泊不仅为人们提供了分析yabo88滚球的工具,而且很明确地告诉你,这里有什么样的yabo88滚球。Curran还表示,运用Hadoop的过程中人们就可以增加对yabo88滚球的认识。这是一个递增的、有机的大规模yabo88滚球库。当然,这样一来,对使用者的技术要求相应地会比较高。
?
  Loconzolo表示,Intuit拥有自己的yabo88滚球湖泊,这个yabo88滚球湖里既有用户点击量的yabo88滚球,也有企业和第三方的yabo88滚球,所有这些都是Intuit分析云端的一部分,但关键是要让围绕这个yabo88滚球湖的工具能够为人们有效利用起来。Loconzolo还说,对于在Hadoop建立yabo88滚球湖,一个需要考虑的问题是,这个平台并没有完完全全的为企业的需求设置周全。“我们还需要传统企业yabo88滚球库已经有了几十年的一些功能,比如监控访问控制、加密、安全性以及能够
?
  2.云端大yabo88滚球分析
?
  Hadoop是一组有一定框架结构的工具,用来处理大型yabo88滚球组。它原本用于机器群,但现在情况有所变化。Forrester Research一位分析师BrianHopkins表示,现在有越来越多的技术可以运用到云端yabo88滚球处理上来了。比如亚马逊的BIyabo88滚球库、Google的 BigQueryyabo88滚球分析服务,、IBM’sBluemix 云平台和亚马逊的Kinesisyabo88滚球处理服务。这位分析师还说,未来的大yabo88滚球将是内部yabo88滚球部署与云端yabo88滚球的结合体。
?
  Smarter Remarketer是SaaS零售分析、市场细分和营销服务的供应商,它最近将自己室内的Hadoop和MongoDByabo88滚球库基础设施转移到了一个基于云技术的yabo88滚球库—Amazon Redshift. 这家位于印第安纳波利斯的公司收集线上和实体销售yabo88滚球、顾客信息和实时行为yabo88滚球,之后进行分析,从而帮助零售商做出针对消费者的决策,有些决策甚至是实时的。
?
  Abbott表示,Redshift可以节省这家公司的成本,这是因为它对于结构yabo88滚球拥有强大的汇总报告功能,而且它颇具规模,使用起来相对容易。用这些虚拟设备总是要比那些实体设备便宜一些。
?
  相比之下,位于加州山景城的Intuit在走向云分析的过程中就要谨慎多了,因为它需要一个安全、稳定、可控的环境。目前为止,这家金融软件公司的yabo88滚球都还在自家的yabo88滚球库—Intuit Analytics Cloud里面。Loconzolo表示:“目前我们正跟亚马逊还有Cloudera合作,建立一个我们几家公司公用的能跨越虚拟、现实两个世界的、具有高度稳定性的云端,但是现在这个问题还没有得到解决。”然而,可以说,对于像Intuit这种销售云端产品的公司来说,向云端技术进军是必然的。Loconzolo还说道,未来我们会发展到一个阶段,那时把yabo88滚球放在私有云端将是浪费的。
?
  3. Hadoop:一个新的企业yabo88滚球运行系统
?
  Hopkins表示,向MapReduce这样的分布式分析框架,正在逐渐演化成分布式资源管理器,这些资源管理器正逐步将Hadoop变为多用途yabo88滚球运行系统。“有了这些系统,你就可以进行多种多样的操作和分析。”
?
  这对企业来说意味着什么呢?SQL、MapReduce、in-memory、流水式处理、图表分析还有其它工作都能在Hadoop上进行,越来越多的企业会把Hadoop当做企业yabo88滚球中心。Hopkins还说:“在Hadoop上能进行各种各样的yabo88滚球处理工作,这样的话,Hadoop会慢慢变成一个多用途的yabo88滚球处理系统。”
?
  Intuit已经开始在Hadoop建立自己的yabo88滚球基地了。Loconzolo说:“我们的策略是利用Hadoop分布式文件系统,因为它和MapReduce与Hadoop等联系十分密切,这样的话,人与产品之间的各种互动就可以实现了。
?
  从源头到去向地追踪yabo88滚球等等。
?
  4.更多预测分析
?
  Hopkins表示,有了大yabo88滚球,分析师们不仅有了更多的yabo88滚球可以利用,也拥有了更强大的处理打量不同属性yabo88滚球的能力。
?
  他说:“传统的机器学习利用的yabo88滚球分析是建立在一个大yabo88滚球集中的一个样本基础上的,而现在,我们拥有了处理了大量数字记录的能力,甚至于每条yabo88滚球有多种不同属性,我们都应对自如。”
?
  大yabo88滚球与计算功能的结合也让分析师们能够挖掘人们一天中的行为yabo88滚球,好比他们访问的网站或者是去过的地方。Hopkins把这些yabo88滚球称作“稀少yabo88滚球(sparsedata)”,因为要想得到这些你感兴趣的yabo88滚球,必须过滤掉一大堆无关的yabo88滚球。“要想用传统机器算法对抗这种yabo88滚球,从计算角度来讲几乎不可能。因为计算能力是一个十分重要的问题,特别是现在传统算法的速度和记忆储存能力退化很快。而现在你可以很容易知道哪些yabo88滚球是最容易分析的,不得不说,赛场易主了。”
?
  Loconzolo表示:“我们最感兴趣的地方是,怎样在同一个Hadoop内核中既能作实时分析,又能做预测模型。这里最大的问题在于速度。Hadoop花费的时间要比现有技术长20倍,所以Intuit也在尝试另一个大规模yabo88滚球处理器Apache Spark及其配套的 Spark SQL查询工具。Loconzolo说:“Spark具有快速查询、制表服务和分组功能。它能在把yabo88滚球保留在Hadoop内部的前提下,还将yabo88滚球处理得十分出色。”
?
  5.Hadoop的结构化查询语言(SQR, StructuredQuery Language):更快,更好
?
  Gartner一位分析师表示,如果你是个不错的编码员或者数学家,你可以把yabo88滚球丢进Hadoop,想做什么分析就做什么分析,这是好处,但同时这也是个问题。“尽管任何程序语言都行得通,但我需要有人把这些yabo88滚球用我熟悉的形式或者语言输入进去,这也是为什么我们需要Hadoop的结构化查询语言。支持与SQR类似的查询语言的工具,让那些懂得SQR的企业使用者们能把类似的技术运用在yabo88滚球上。Hopkins认为,Hadoop的SQR打开了企业通往Hadoop的大门,因为有了SQR,企业不需要在那些能使用Java, JavaScript 和Python高端yabo88滚球和商业分析师上投资了,而这些投资在以前可是少不了的一笔开销。
?
  这些工具也并非最近才出现的了。Apache Hive曾经为用户提供了一种适用于Hadoop、类似于SQR的查询语言,但是竞争对手Cloudera、PivotalSoftware、IBM还有其他销售商提供的产品不仅性能更好,速度也更快。这项技术也适合“迭代分析(iterative analytics)”,也就是说,分析师先问一个问题,得到回答之后再问下一个问题。而这种工作放在过去可是需要建立一个yabo88滚球库的。Hopkins说:“Hadoop的SQR并不是为了取代yabo88滚球库,最起码短期不会,但对于某些分析来说,它让我们知道,除了那些高成本的软件和应用之外,还有别的选择。”
?
  6.不仅仅是SQR(NoSQL,NotOnly SQR)—更快,更好
?
  Curran表示,现在我们除了基于SQR的传统的yabo88滚球库之外,还有NoSQL,这个yabo88滚球库能用于特定目的的分析,当下十分热门,而且估计会越来越受欢迎。他粗略估计目前大概有15-20个类似的开放资源NoSQL,每一个都独具特色。比如ArangoDB,这是一款具备图标分析功能的产品,能更快、更直接地分析顾客与销售人员之间的关系网。
?
  Curran还说,开放资源的NoSQLyabo88滚球库已经存在一段时间了,但是他们依然势头不减,因为人们需要它们所做的分析。一位在某个新兴市场的普华永道客户把传感器按在了店面柜台上,这样就能监控到那里到底有什么产品,顾客会摆弄这些产品多长时间以及人们会在柜台前站多久。“传感器会产生大量类似指数增长的yabo88滚球,NoSQL将是未来的一个发展方向,因为它可以针对特定目的进行yabo88滚球分析,性能好,而且很轻巧。”
?
  7.深度学习
?
  Hopkins认为,作为一种基于神经网络的机械学习技术,虽然还在发展过程中,但在解决问题方面却已经表现出巨大的潜力。“深度学习……能够让计算机在大量非结构化和二进制的yabo88滚球中识别出有用信息,而且它能够在不需要特殊模型和程序指令的前提下就剔除那些不必要的关系。”
?
  举个例子说明:一个深度学习的算法通过维基百科了解到加利福尼亚和德克萨斯是美国的两个州。“我们不在需要通过模式化让程序去理解州和国家的概念,这就是原来的机械学习和新兴深度学习的区别之一。”
?
  Hopkins还说道:“大yabo88滚球运用先进的分析技术,例如深度分析,来处理各种各样的非结构文本,这些处理问题的思路和方式,我们也是现在才开始理解。”比如,深度学习可以用来识别各种各样不同的yabo88滚球,比如形状、颜色和录像中的物体,甚至是图片中的猫—谷歌建立的神经网络就做到了这一点。“这项技术所昭示的认知理念、先进的分析,将是未来的一个趋势。”
?
  8.内存中分析
?
  Beyer表示,利用内存中yabo88滚球库来提升分析处理速度,这种方式已经越来越广泛,而且只要运用得当,益处也很多。事实上,很多企业现在已经在利用HTAP(hybridtransaction/analytical processing)了,这种处理方式能在同一个内存yabo88滚球库中进行转换和分析处理。但Beyer同时也表示,对于HTAP的宣传有些过头了,很多公司也过度利用这项技术。对于那些使用者需要每天多次以同样的方式看同样yabo88滚球的系统来说,这样的yabo88滚球没有太大变化,这时用内存中分析就是一种浪费了。
?
  虽然有了HTAP的帮助,人们分析速度更快了,但是,所有的转换都必须储存在同一个yabo88滚球库里。Beyer认为,这样的特点就产生了一个问题,分析师们目前的工作主要是把不同地方的yabo88滚球汇总输入到同一个yabo88滚球库当中去。“如果你想做任何分析都运用HTAP,所有的yabo88滚球就得存在同一个地方。要把多样化的yabo88滚球进行整合。”
?
  然而,引入内存yabo88滚球库的同时也意味着,还有另一个产品等着我们去管理、维护、整合与权衡。
?
  对于Intuit而言,他们已经在使用Spark了,所以对引进内存yabo88滚球库的愿望并没有那么强烈。Loconzolo说:“如果我们用Spark就能处理70%的问题,而用内存yabo88滚球库可以解决100%,那么我们还会选择前者。所以我们现在也在权衡,要不要马上停用内部的内存yabo88滚球系统。”
可思yabo88滚球

网友评论:

发表评论
请自觉遵守互联网相关的政策法规,严禁发布色情、暴力、反动的言论。
评价:
表情:
用户名: 验证码:点击我更换图片 匿名?

Copyright?2005-2019 Sykv.com 可思yabo88滚球 版权所有 ?? 网站地图?? 联系我们?? 京ICP备14056871号

人工智能资讯?? 人工智能资讯?? 人工智能资讯?? 人工智能资讯

?扫码入群
咨询反馈
扫码关注

微信公众号

返回顶部
关闭