为什么说现在是大数据处理的最佳时机?

日期: 2012-06-05 作者:Cameron McKenzie翻译:蒋红冰 来源:TechTarget中国 英文

毫无疑问,大数据管理现在已经成为企业开发社区中的一大热门话题。但为什么大数据的讨论会这么晚?为什么过去大数据的处理没有成为企业工具集的一部分,是不是现在的信息技术生态系统使得大数据解决方案变得如此的明智。   无需言明,大数据管理如此流行的一个关键原因是,多数组织不得不对日益增长的数据进行管理。从互联网搜索引擎,到庞大信息量的检索,再到基因科学或大气科学的研究项目,人们关注并尝试的数据量变得越来越庞大。

曾经兆字节数据的处理就已经很惊人了,但与现在组织面临的千万兆字节相比,就变得苍白无力了。   处理能力是关键。一方面它要有能力存储巨大的数据;另一方面它要能够进行处理。毕竟,如果它不能被挖掘出来……

我们一直都在努力坚持原创.......请不要一声不吭,就悄悄拿走。

我原创,你原创,我们的内容世界才会更加精彩!

【所有原创内容版权均属TechTarget,欢迎大家转发分享。但未经授权,严禁任何媒体(平面媒体、网络媒体、自媒体等)以及微信公众号复制、转载、摘编或以其他方式进行使用。】

微信公众号

TechTarget微信公众号二维码

TechTarget

官方微博

TechTarget中国官方微博二维码

TechTarget中国

毫无疑问,大数据管理现在已经成为企业开发社区中的一大热门话题。但为什么大数据的讨论会这么晚?为什么过去大数据的处理没有成为企业工具集的一部分,是不是现在的信息技术生态系统使得大数据解决方案变得如此的明智。

  无需言明,大数据管理如此流行的一个关键原因是,多数组织不得不对日益增长的数据进行管理。从互联网搜索引擎,到庞大信息量的检索,再到基因科学或大气科学的研究项目,人们关注并尝试的数据量变得越来越庞大。曾经兆字节数据的处理就已经很惊人了,但与现在组织面临的千万兆字节相比,就变得苍白无力了。

  处理能力是关键。一方面它要有能力存储巨大的数据;另一方面它要能够进行处理。毕竟,如果它不能被挖掘出来,还能用什么来存储数据?谈到数据挖掘,我们讲的是用比挖掘煤矿还快的速度处理数据。如果我们不能在合理的时间内,从数据中找到有意义的信息,那么它就是无用的。

  现在,管理大数据非常可行,因为处理能力可以负担得起。过去,财富500强公司需要稀释他们的股份和发行更多普通股,为了能够购买多元处理器,这样就能够存储兆字节的数据。但是现在一个小学生,用他的零用钱就可以买到等价处理能力的处理器。

  另外,确实和过去的需求不一样,需要走出云,从像Oracle和IBM那样的公司中,购买大的硬件和令人印象深刻的工作站。而一个明智的IT部门可以从网上轻而易举的购买到上百个主板和多核处理器,并以历史上最低价从台湾直接装运过来。而开源软件可以用来把各种各样的主板、处理器编成组,而国产的处理器处理能力可以以千兆位字节吞噬掉非结构化的数据。

  伴随着处理能力,免费软件也有能力强化大数据运动。HBase之类的工具可以把大数据存储在单一数据库表中,或海量数据库表中,海量数据库表可以扩展出数十亿的行和数以百万的列。从那里,如果你有兴趣挖掘你的HBase数据,Hadoop可以帮助你处理那些海量数据集,并理解其不断积累的信息。

  “如果想得到特殊的东西,你可以访问HBase领域的数据;但如果想获得关于分析的一些数据,比如说,你希望在数十亿的记录中,找到某个星球的平均年龄,那么你可以使用Hadoop。”Java之父,James Gosling说。“它最终会非常快速并且非常高效。”

  累积的大量数据池、处理能力的负担能力和专业化软件的可用性,这三大理由不仅使“大数据”成为互联网的一个敏锐话题,也成为了管理信息的一个可行方法。结合了廉价的处理能力,并且能够免费的下载,通过像Hadoop和HBase这样的开源软件解决方案,企业架构师们用更新,更有效的工具来处理大数据了。随着越来越多的公司从一系列不同的输入输出中,收集了更多的信息,使得大数据处理能力达到前所未有的巅峰。

翻译

蒋红冰
蒋红冰

TechTarget云计算主编,主要负责云计算和虚拟化网站的内容建设。长期专注于IT前沿技术,对云计算、虚拟化、人工智能、区块链等技术都有了解;对行业趋势、市场动态有一定的洞察。

相关推荐