申耀的科技观察

读懂科技,赢取未来!

要说近几年存储这条街最靓的仔,莫过于分布式存储了。

自诞生以来,分布式存储就被视为存储的未来,被万众期待。然而分布式存储起步于寒门,最早应用于互联网日志、企业备份归档、开发测试等场景,追求极致成本,性能和可靠性却不敢恭维。但它还算争气,凭借多年的打怪练级,越来越多地开始承载自动驾驶研发、超高清编辑、运营商5G网络云等企业的关键业务,走上变成高富帅、赢取白富美的道路。

正所谓人红是非多,存储领域也是一样,坊间一直流传着关于分布式存储的各种流言蜚语。好事的笔者今天就来探寻一番,揭开谎言背后的真相。

谎言一:

分布式存储就是软件+服务器

目测分布式存储领域有两个派系,一派是SDS(软件定义存储),一派是软硬一体。前者以vSAN、Ceph为代表,以软件厂商为主在推广。分布式存储软件+通用服务器组合,打着重定义存储市场的旗帜,颇有“有王侯将相宁有种乎”的气势;另一派是存储老牌存储玩家的产品,他们以软硬一体为主,如Isilon、HCP等。

楚河汉界已然形成,未来谁主沉浮?

谁主沉浮很难判断,不过我们不妨从产业动态窥见一斑。虽然用过的客户都诟病分布式存储软件+服务器的方式存在各种兼容性、可靠性、可维护性的问题,但笔者认为SDS这种模式会长期存在,尤其是在传统的低端领域,如备份归档、开发测试环境。而越往高端走,软硬一体越是占据主流。业界主流厂商也在持续推出软硬一体的产品:

国外,DELL&EMC的PowerScale(Isilon)、DDN的EXAScaler等产品;

国内XSKY、浪潮等Ceph系开源厂商也推出了软硬件一体产品如XScaler Express。尤其有趣的是XSKY,这可是国内Ceph系软件定义存储的旗帜啊,你品,你细品。

另一方面,笔者也注意到近些年运营商开展了大规模的分布式存储集采,有文件的有块的。以中国移动2019~2020年分布式块存储集采为例,3个标段中2个为软硬一体采购,占比超过了90%;电信集团2020年集采也放弃了分布式存储纯软件采购,首次全面转向软硬一体。从这个角度看,用户在尝试了多种采购模式之后,也开始逐步转变到软硬一体的道路上来,尤其是大型用户。

#真相#:分布式存储诞生初期主要是纯软形态,近十年来,随着分布式存储逐步进入企业市场,软硬一体的形成已经成为主流。

谎言二:

分布式存储就是低价值存储

如文章开头讲到的,分布式存储早期主要用于互联网日志、企业备份归档、开发测试等场景,这些场景无疑是低价值场景,成本是第一诉求甚至唯一诉求。

然此一时彼一时,士别三日也当刮目相看。

首先是分布式存储产品能力已今非昔比,逐渐具备了承载企业高价值业务的关键能力,例如毫秒级时延、TB/s级带宽、双活/3DC业务级容灾、端到端DIF等,无论是结构化数据还是非结构化数据的承载,功能完备性的最大短板早已补齐。

其次,分布式存储已走入众多高价值关键业务,如运营商BOM业务、金融渠道类业务以及超算、油藏探测HPC等高价值业务,通过大规模应用实践来检验成色。(小道消息,某些高价值场景全闪出货价达到1000美金/TB以上啦)

看完当下还要看看未来,笔者认为未来高价值的非结构化数据场景,分布式存储的版图还会持续扩展。如自动驾驶训练、4K/8K超高清、5G日志留存等场景,对多协议访问、极致带宽、扩展性诉求强烈,分布式存储已然成为这些未来业务的首选架构。

#真相#:分布式存储早期主要用在备份归档等低价值、强成本诉求的场景,如今随着企业级能力的提升,分布式存储也逐步成为企业生产系统的承载平台,尤其是面向海量非结构数据场景,全面支撑文件资源池和HPC等高价值场景。

谎言三:

开源架构是分布式存储的未来

笔者对开源从来是持开放、支持的态度,正是因为开源的存在,IT产业才能有今天的缤纷色彩;也正是因为开源,存储这个高大上的产品,才走进了更多的寻常百姓家。

但如果说存储的未来在开源,我不敢苟同。

开源分布式存储软件的出现,一定程度上降低了存储的门槛,小公司可快速包装出存储产品,带动服务器销售。但产品同质化问题是所有开源不得不面临的问题,由于架构限制,很难在不动架构的情况下,真正做出差异化竞争力。互联网类公司、部分科研机构,以及有技术情结和充足资金投入的客户可能选择开源,而对于金融、电信运营商、大企业商用HPC、政府等对可靠性、性能、安全合规有要求的企业,开源从来不是第一选择,因为数据太重要了。(听说,国内某知名银行曾经投入500人基于开源软件搭建分布式存储,投入巨大且无法达银行业务对性能、可靠性、易运维诉求,最终于2年后放弃。)

也有认为开源更自主可控的。笔者认为开源给了用户一定的自主权,但和自主可控是两个概念。据SNYK 2019 年开源安全状况报告说明,开源软件漏洞在两年时间内增加了88%,开源风险的解决强依赖于社区版本发布,不能及时规避。同时,近两年国际形势的大变化,给开放著称的开源蒙上了一层阴影。

此外,业界TOP主流分布式存储产品均是闭源架构,如PowerScale(Isilon)、Spectrum Scale、Nutanix、OceanStor Pacific、VSAN、HCP,翻看了一下三个月前发布的IDC市场份额报告,TOP5分布式存储厂商中,基于开源二次开发的厂商份额仅占18%。

#真相#:开源只是部分厂商的商业选择,分布式存储产业的主流还是非开源,并且开源并不代表更加自主可控。

谎言四:

分布式存储可全面取代企业外置存储

这是一个在存储领域争论最大的问题。

正所谓长江后浪推前浪,分布式存储快速增长是不可否认的,这从各大厂商的业绩报告和分析师报告就能看出来,但想要把企业外置存储这个前浪拍死在沙滩上还是步子迈太大,不现实。

企业外置存储在相当长的一段时间内,仍然是主流。它主要面向企业传统应用如ERP/CRM/HIS等,数据量不大但对可靠性、性能有极致要求,如银行Core-Banking,从可靠性、生态层面,分布式存储都不是最佳选择。分布式存储主要面向海量数据、新兴业务场景,如HPC/EDA、大数据,这类场景以二进制文件、视频、图片等非结构化数据为主,数据量极大。所以从场景来看,二者场景是有明确区隔的,按场景并存是最好的选择。

从技术的角度,分布式存储的发力点在大规模的扩展性,基于此逐步优化性能、可靠性,让海量数据存得下、用得起;集中式存储的技术方向在于保持稳定性的基础上,利用更快的介质、更低时延的网络为核心业务提供加速,让业务更稳、效率更高。因此,从技术方向上来看,二者也是各有侧重的。

#真相#:分布式存储和企业外置存储并非取代关系,二者相辅相成、互为补充。企业外置存储主要面向结构化数据市场,分布式存储主要面对海量非结构化数据市场(高价值分布式文件、分布式对象)。

谎言五:

分布式存储就是“云”

IT潮流滚滚向前,每隔几年总是需要有一些新概念。

云和分布式存储一样,这些年正在大行其道、炙手可热。Cloud First、All in Cloud、Cloud Native等概念风靡业界,CIO见面不提云貌似都不好意思打招呼。早期人们也习惯把分布式存储叫做“云存储”,那么分布式存储和云是什么关系?

笔者认为,分布式存储是一种技术架构,而云是一种商业模式。分布式存储可以被用作各种云的数据底座,也可以单独成为数据底座,是配合的关系,而非替换和包含关系。

其实,从与业界公有云厂商的沟通了解到,公有云虽然近年来加强对传统IT市场的转换,但公有云数据增长更多还是来自新兴场景。以美国市场为例,近年来AWS持续快速增长,但PowerScale(Isilon)作为Dell&EMC面向非结构化数据场景的主力产品,并且近60%的销售收入来自于北美市场,依然保持以每年近20%的速度稳步增长。

从场景看,多数海量存储场景,因客户数据安全、生态、招标模式等原因,以线下采购为主,公有云为辅助。以HPC为例,云上HPC给业界提供了一种新的方式,让更多用户能享受到公有云带来的便利性。但实际上HPC主要用于创新研究,对数据安全要求高,上云是有顾虑。参考Hyperion Research报告显示,到2024年云上HPC的收入占比仅17.7%,收入占比很低。

#真相# :分布式存储是一个产品,云是一种商业模式是一种服务形式,二者不冲突,长期共存是未来。

申耀的科技观察,由科技与汽车跨界自媒体人申斯基创办,18年企业级媒体工作经验,专注产业互联网、企业数字化、渠道生态以及汽车科技内容的观察和思考。

乱花渐欲迷人眼:浅谈关于分布式存储的五大 “谎言”相关推荐

  1. 乱花渐欲迷人眼的C编译器中,谁才是“编译之王”?

    C语言作为"万物的始祖",所有刚接触的小伙伴都在使用C语言,然而不胜枚举的C语言编译器让人眼花缭乱,VScode.GCC.TCC--那么到底哪些C语言编译器是大佬们用的最多的?又有 ...

  2. 计算机科学选AP课,乱花渐欲迷人眼,AP课程如何选 之 理科

    美国高中AP课程有22个门类.37个学科,AP 考试的成绩为5分制,考生可以获得1,2,3,4或5分.一般3分或3分以上的成绩可以在大学换取学分,但有些名牌大学接受的标准在4分以上或者5分,还有的大学 ...

  3. Web3中文|乱花渐欲meme人眼,BRC-20总市值逼近10亿美元

    现在的Web3加密市场,用"乱花渐欲meme人眼"来形容再合适不过了. 何为meme? "meme"这个词大概很多人都不知道如何正确发音,并且一看到它就会和狗狗 ...

  4. 乱花渐欲迷人眼-杜绝设计的视噪

    视噪,又称视觉噪音.我们每天接受来自外界的大量信息,这些信息有将近70%是通过视觉感知获得的.视噪会干扰我们对信息的判断,影响到产品的易用性和可用性,与用户体验的好坏息息相关. (克劳德香农图演示了噪 ...

  5. 浅谈Python Web的五大框架

    说到web framework,Ruby的世界Rails一统江湖,而Python则是一个百花齐放的世界,各种micro-framework.framework不可胜数,不完全列表见:http://wi ...

  6. 浅谈供应链管理SCM的五大功能

    众所周知,供应链管理SCM是确保您在需求和供应之间保持平衡,并最终涉及采购材料并将其转换为制成品,然后在预期的时间内交付.供应链管理对于任何企业来说都是很必要的,而且一般是大多数业务的支柱. 供应链管 ...

  7. 【行业共话】币码翁研究院浅谈关于分布式存储四大真相

    在存储领域,要说近几年存储这条街最靓的仔,莫过于分布式存储了.随着新技术的突破,加上近两年区块链热度不断攀升,分布式存储领域被拉响号角,有点气势逼人的感觉. 自诞生以来,分布式存储就被视为存储的未来, ...

  8. 程序员的真实价值,浅谈职业生涯规划

    前言 随着移动互联网的普及,催生了大量各种互联网相关的职业,也有大批的青年才俊涌入了这个市场,虽然是蓝海,红利满满,但是如何能在这一波浪潮下激荡向前,而不是像浪花一样昙花一现?可以从这波互联网行业的职 ...

  9. 浅谈金达莱花在朝鲜族家居装饰中的传承发展

    浅谈金达莱花在朝鲜族家居装饰中的传承发展 摘要:金达莱花历史悠久.风格独特,已经成为韩国传统文化的标志之一.然而金达莱花的诞生距今已经有几百年的历史,朝鲜民族将金达莱看成是春天的使者,坚贞.美好.吉祥 ...

最新文章

  1. 什么叫单模光纤_什么叫单模光纤_单模光纤的特点是什么
  2. 使用 Sphinx 撰写技术文档并生成 PDF 总结
  3. 四种π型RC滤波电路
  4. 简而言之,JUnit:测试隔离
  5. employee.java,Java基础系列(六):对象与类(上)
  6. 补天五星计划范围更新,还有单个漏洞额外10000元现金奖励?!
  7. php 打乱数组的顺序,php数组打乱顺序
  8. golang IDE下载安装
  9. oracle delete误删除表数据进行恢复
  10. 利用计算机可视化画一个矩形,可视化程序设计大作业题目
  11. 刘士颉老师——德鲁克“卓有成效”管理理论的践行者,曾任宜信公司培训负责人
  12. 如何搜索相似的图片,如何通过识别图像搜索图片
  13. 谷粒商城:环境搭建(3)
  14. 千万别在老家买房了,因为那儿通高铁
  15. 一些有用的Latex模板(持续更新)
  16. Mac Terminal 终端:入门指南及进阶技巧
  17. ScriptX.cab打印经验交流
  18. 什么样的UI设计是高级UI设计?【萧蕊冰】
  19. matlab用plot三点画圆_怎样用Matlab 过三个点画外接圆?
  20. 电子信息专业见习报告

热门文章

  1. Sulley vmcontrol.py 使用注意
  2. 单系统 台电x80pro_台电X80 Pro (E6E9)-双系统安装文件平板固件
  3. Android程序员现状:没有架构师的命,却得了架构师的病!
  4. pdf转换成jpg格式快准狠的转换方法
  5. js实现点击上一题和下一题出现对应的题目,
  6. Linux基础----文件管理、用户管理、用户权限
  7. 安装谷歌扩展插件:程序包无效
  8. ExpandableListView 去掉默认箭头,设置成别的图片
  9. <_main__.类名 object at 0x0000000002A7CEB8>
  10. Windows10优化系统,优化达到30多项,速度大幅提升,