解析大数据存储平台应用中弹性的必要性

目前,对于“大数据”的讨论很多,公认的看法是将大数据的系列问题归纳为:海量的数据规模(volume)、快速的数据流转和动态的数据体系(velocity)、多样的数据类型(variety)和巨大的数据价值(value),以及我们的对策。但实际上,大数据首先要考虑的应该是“大”–海量的数据规模。由此看来,大数据存储的首要需求存储容量可扩展。本文将讲述现阶段不断生长的大数据在存储平台中遇到的技术问题。

【安防在线 www.anfang.cn】
目前,对于“大数据”的讨论很多,公认的看法是将大数据的系列问题归纳为:海量的数据规模(volume)、快速的数据流转和动态的数据体系(velocity)、多样的数据类型(variety)和巨大的数据价值(value),以及我们的对策。但实际上,大数据首先要考虑的应该是“大”–海量的数据规模。

大数据之“

大”

“大”是相对而言的概念。例如,对于像SAPHANA那样的“内存数据库”来说,2TB可能就已经是大容量了;而对于像谷歌这样的搜索引擎,EB的数据量才能称得上是大数据。

解析大数据存储平台应用中弹性的必要性

“大”也是一个迅速变化的概念。HDS在2004年发布的USP存储虚拟化平台具备管理32PB内外部附加存储的能力。当时,大多数人认为,USP的存储容量大得有些离谱。但是现在,大多数企业都已经拥有PB级的数据量,一些搜索引擎公司的数据存储量甚至达到了EB级。由于许多家庭都保存了TB级的数据量,一些云计算公司正在推广其文件共享或家庭数据备份服务。

有容乃“

大”

由此看来,大数据存储的首要需求存储容量可扩展。大数据对存储容量的需求已经超出目前用户现有的存储能力。我们现在正处于PB级时代,而EB级时代即将到来。过去,许多企业通常以五年作为IT系统规划的一个周期。在这五年中,企业的存储容量可能会增加一倍。现在,企业则需要制定存储数据量级(比如从PB级到EB级)的增长计划,只有这样才能确保业务不受干扰地持续增长。这就要求实现存储虚拟化。存储虚拟化是目前为止提高存储效率最重要、最有效的技术手段。它为现有存储系统提供了自动分层和精简配置等提高存储效率的工具。拥有了虚拟化存储,用户可以将来自内部和外部存储系统中的结构化和非结构化数据全部整合到一个单一的存储平台上。

当所有存储资产变成一个单一的存储资源池时,自动分层和精简配置功能就可以扩展到整个存储基础设施层面。在这种情况下,用户可以轻松实现容量回收和容量利用率的最大化,并延长现有存储系统的寿命,显著提高IT系统的灵活性和效率,以满足非结构化数据增长的需求。中型企业可以在不影响性能的情况下将HUS的容量扩展到近3PB,并可通过动态虚拟控制器实现系统的快速预配置。此外,通过HDSVSP的虚拟化功能,大型企业可以创建0.25EB容量的存储池。随着非结构化数据的快速增长,未来,文件与内容数据又该如何进行扩展呢?

不断“

生长”

的大数据

与结构化数据不同,很多非结构化数据需要通过互联网协议来访问,并且存储在文件或内容平台之中。大多数文件与内容平台的存储容量过去只能达到TB级,现在则需要扩展到PB级,而未来将扩展到EB级。这些非结构化的数据必须以文件或对象的形式来访问。基于Unix和Linux的传统文件系统通常将文件、目录或与其他文件系统对象有关的信息存储在一个索引节点中。索引节点不是数据本身,而是描述数据所有权、访问模式、文件大小、时间戳、文件指针和文件类型等信息的元数据。传统文件系统中的索引节点数量有限,导致文件系统可以容纳的文件、目录或对象的数量受到限制。HNAS和HCP使用基于对象的文件系统,使得其容量能够扩展到PB级,可以容纳数十亿个文件或对象。位于VSP或HUS之上的HNAS和HCP网关不仅可以充分利用模块存储的可扩展性,而且可以享受到通用管理平台HitachiCommandSuite带来的好处。

HNAS和HCP为大数据的存储提供了一个优良的架构。大数据存储平台必须能够不受干扰地持续扩展,并具有跨越不同时代技术的能力。数据迁移必须在最小范围内进行,而且要在后台完成。大数据只要复制一次,就能具有很好的可恢复性。大数据存储平台可以通过版本控制来跟踪数据的变更,而不会因为大数据发生一次变更,就重新备份一次所有的数据。HDS的所有产品均可以实现后台的数据移动和分层,并可以增加VSP、HUS数据池、HNAS文件系统、HCP的容量,还能自动调整数据的布局。传统文件系统与块数据存储设备不支持动态扩展。大数据存储平台还必须具有弹性,不允许出现任何可能需要重建大数据的单点故障。HDS可以实现VSP和HUS的冗余配置,并能为HNAS和HCP节点提供相同的弹性。大数据存储平台需要将文件、块数据和内容集成到一个统一的HitachiCommandSuite管理平台之上,以满足大数据处理和应用的需求。

该文观点仅代表作者,本站仅提供信息存储空间服务,转载请注明出处。若需了解详细的安防行业方案,或有其它建议反馈,欢迎联系我们

(0)

相关推荐

  • 武汉:智能化大数据分析平台提升警务质效

    七大队民警杨根登录“CIIS平台”进入系统后,记者看到,接处警、受立案、一体化采集、统计分析、办案工具、检验鉴定、技术侦查、执法回告、态势感知等17个功能模块承担不同环节的“任务”。从接警到受立案、侦办,以及相关技术支撑的32类侦查措施都可以在同一个平台完成,工作流、信息流、数据流真正“三流合一”。

    2026年4月14日
  • 国内外城市智能交通发展现状

    让相关机构全面准确地掌握整个城市的交通信息,为交通疏导、城市规划等提供实用的数据及解决方案。让交通信息无处不在,在任何地方都能以最恰当的方式为群众提供最有价值的交通信息,这就是智能交通。本文将讲述我国智能交通的发展现状以及国外智能交通的发展现状。

    2026年4月14日
  • 云存储中的数据迁移安全性问题分析

    云存储作为云中的一项重要服务,它通过集群应用、网格技术或分布式文件系统等将各种存储设备通过应用软件集合起来,对外提供数据存储和业务访问。数据迁移作为采用云存储方案中最为基础、关键的步骤。它将历史数据进行清洗,转换,并装载到新系统,它是保证数据系统平滑升级和更新的重要环节,也是将来系统稳定运行的有效保障。在整个云存储方案中占有了举足轻重的作用,在本文中我们将对数据迁移进行探讨。

    2026年4月14日
  • 在环保领域中的高清智能监控应用

    针对环保监控的实际需求,结合先进的技术及应用,笔者提出了一套高清智能网络化环保监控方案,方案以IP传输网络,H。264 协议群为传输基础,是集1080p、720p高清图像、音频监控及对讲、数据叠加、智能化分析及告警、可视化指挥调度为一体的综合型应用系统。

    2026年4月13日
  • 全球人工智能与机器人峰会正式召开 产学研三界大咖论道AI发展

    2018全球人工智能与机器人峰会(CCF-GAIR)在深圳召开,峰会由中国计算机学会(CCF)主办,雷锋网、香港中文大学(深圳)承办,得到了深圳市政府的大力指导,是国内人工智能和机器人学术界、工业界及投资界三大领域的交流盛会,旨在打造国内人工智能领域的跨界交流合作平台。

    2026年4月13日
  • 云对象存储:整合元数据让数据结构化

    有不少企业用户疲于调整现有的内部IT基础架构和传统数据仓库。通过云对象存储服务,提供商不仅提供了成本削减,也解决了客户和大数据管理的相关技术挑战。使用块存储技术处理大数据要求企业构建一个复杂的数据模型,来提前组织非结构化数据。而对象存储可以通过让企业整合元数据到其非结构化数据中消除代价昂贵的步骤云存储是处理大量结构不是很好的数据的更加轻松的方式,但是应该和存储放在一起来处理。

    2026年4月13日