浪潮分布式存储:让数据融合互通,为“云数智”应用构筑新平台

发布时间:2023-02-03  

数字时代,数据共享互通成为刚需

数字经济时代,云计算、大数据、人工智能等新技术快速发展,非结构化数据爆发式增长,数据类型变得愈发复杂多样。在自动驾驶、基因测序、气象预报等云数智应用场景中,一次数据处理可能会涉及到文件、对象、大数据等多种协议,数据间的互通转换成为数据存储中至关重要的一环,具备平台化能力的融合存储成为数字基础设施建设的核心。

以基因测序场景为例,一次完整的基因测序涉及到数据采集、格式化、脱敏、压缩、分析、发布等操作,其过程可以大致分为样本采集、DNA/RNA测序、数据分析和发布四个步骤。在不同的处理阶段,需要使用不同的数据协议进行操作。其中在样本采集和DNA/RNA测序阶段采用NFS文件协议,数据分析阶段采用HDFS大数据协议,数据发布阶段则是通过公网数据共享采用S3对象协议。整个数据处理过程涉及三种协议格式,这就意味着完成一次基因的测序流程需要在NFS、HDFS和S3之间进行两次数据拷贝和数据格式的转换。传统存储仅支持单一的访问协议,这就会造成两个问题:一是数据格式转换和数据拷贝会降低整个数据处理流程的效率;二是多套存储副本增加存储空间成本。

基因测序应用需要使用多种数据协议
基因测序应用需要使用多种数据协议

百川入海:浪潮基于一套存储 承载多样化数据

浪潮分布式存储平台AS13000基于对非结构化数据协议(NFS/CIFS/HDFS/S3)融合互通的研究进行技术创新,采用统一的数据管理和元数据管理、统一的增值特性服务、统一的分布式存储资源池和统一的管理软件系统,保证各种协议共享同一份数据和元数据。访问过程中无需数据转换和拷贝,并且为每种协议提供原生语义服务,每种服务均可直接访问,无需安装网关、插件或在计算侧或应用层进行改造。

1.jpg
AS13000非结构化数据融合架构

基于"多合一"极简架构,浪潮分布式存储得以实现四个"统一"。

首先,提供统一的数据管理和元数据管理。

数据管理和元数据管理是非结构化数据存储的关键,浪潮分布式存储平台AS13000根据NFS、CIFS、HDFS和S3的语义和元数据特点,抽象各协议的数据和元数据操作,通过一套统一的非结构化数据和元数据管理架构有效地保证各协议的原生访问。

其次,提供统一的增值特性服务。

基于统一的数据访问接口和元数据管理的架构设计,浪潮AS13000对外提供统一的增值特性服务,包括统一配额、QoS、加密、压缩、快照、回收站、分级存储、远程复制、元数据检索等等。

以下图为例:同一个元数据检索服务ElasticSearch支持NFS、CIFS、S3、HDFS多种协议,并且各协议为同一配置入口和查询入口。

2.jpg
统一增值特性示例:元数据检索服务

再次,构建统一的分布式存储资源池。

AS13000支持NFS/CIFS/HDFS/S3等多种服务协议共享非结构化存储资源池,并且同一个文件不同协议访问的数据和元数据为同一份。例如,通过文件NFS协议写入的一个文件,通过对象存储AWS S3协议、大数据HDFS协议和文件CIFS协议均可读取;每个节点都可以启动文件NAS、大数据HDFS和对象存储S3服务。

最后,打造统一的管理系统。

管理软件负责集群的安装、部署、业务配置、设备管理、监控、告警等功能。浪潮分布式存储平台AS13000打造了融合互通的管理系统,可同时支持NFS/CIFS/HDFS/S3等多种服务协议,增值特性通过统一的配置入口对所有非结构化存储协议同时生效,减少了企业的管理成本。

浪潮分布式存储平台AS13000通过多年来的持续技术创新,以一份数据支持多种协议访问,实现了非结构化数据融合互通,在提升数据处理效率的同时降低了存储购置和运维成本,保障各协议的语义无损和性能无损,构筑了面向"云数智"应用的融合存储平台,助力企业数字化转型,加速释放数据价值。

文章来源于:ECCN    原文链接
本站所有转载文章系出于传递更多信息之目的,且明确注明来源,不希望被转载的媒体或个人可与我们联系,我们将立即进行删除处理。

相关文章

    联想凌拓发布全新企业级闪存存储系列、数据管理平台; 联想凌拓发布全新企业级闪存存储系列、数据管理平台,并推出新型云服务为数字中国注入科技新动能致力于驱动中国企业释放数据潜能并加速数字化转型的领先智能数据管......
    联想凌拓发布全新企业级闪存存储系列、数据管理平台,并推出新型云服务为数字中国注入;中国北京,2022年12月21日——致力于驱动中国企业释放数据潜能并加速数字化转型的领先智能数据管理......
    及MagnaScale 数据管理平台全面升级,并推出新型云服务,为中国企业提供更为领先的覆盖传统存储、软件定义存储,及云数据管理解决方案,助力中国企业释放数据价值,加速创新发展,为数......
    解决方案。具体来说,平台可为数据库迁移、数据容灾、数据库优化和云数据库管理等场景提供助力,帮助金融、能源、互联网和制造等领域企业高效管理核心数据库,有效降低企业的数据管理难度和成本,为数......
    现万卡级别的训练推理一体化弹性调度,AI算力有效利用率超90%;湖仓一体化平台OpenLake,可提供大数据搜索、AI一体化能力体系;多模数据管理平台DMS,可实现跨云数据库、数据仓库、数据湖统一治理,帮助业务决策提效10倍......
    监控等领域企业可实现人力成本和运营成本的大幅降低。 TDengine Cloud 主要具备以下三点优势: 极简的时序数据管理平台:除高性能、具有水平扩展能力的时序数据库外,TDengine Cloud 还提供缓存、数据订阅、流式计算等功能,无需......
    监控等领域企业可实现人力成本和运营成本的大幅降低。TDengine Cloud 主要具备以下三点优势:极简的时序数据管理平台:除高性能、具有水平扩展能力的时序数据库外,TDengine Cloud 还提供缓存、数据订阅、流式计算等功能,无需再部署 Redis......
    全生命周期透明可控的重要保障。AS15000G7可同时搭载AIStation调度和InView数据管理平台,对高性能服务器、网络、存储设备进行监控和管理,实现对数据全作业流程的透明可控,HDD/SSD寿命......
    全生命周期透明可控的重要保障。AS15000G7可同时搭载AIStation调度和InView数据管理平台,对高性能服务器、网络、存储设备进行监控和管理,实现对数据全作业流程的透明可控,HDD......
    ,提供统一的数据管理和元数据管理数据管理和元数据管理是非结构化数据存储的关键,浪潮分布式存储平台AS13000根据NFS、CIFS、HDFS和S3的语义和元数据特点,抽象各协议的数据和元数据操作,通过一套统一的非结构化数据和元数据管理......

我们与500+贴片厂合作,完美满足客户的定制需求。为品牌提供定制化的推广方案、专属产品特色页,多渠道推广,SEM/SEO精准营销以及与公众号的联合推广...详细>>

利用葫芦芯平台的卓越技术服务和新产品推广能力,原厂代理能轻松打入消费物联网(IOT)、信息与通信(ICT)、汽车及新能源汽车、工业自动化及工业物联网、装备及功率电子...详细>>

充分利用其强大的电子元器件采购流量,创新性地为这些物料提供了一个全新的窗口。我们的高效数字营销技术,不仅可以助你轻松识别与连接到需求方,更能够极大地提高“闲置物料”的处理能力,通过葫芦芯平台...详细>>

我们的目标很明确:构建一个全方位的半导体产业生态系统。成为一家全球领先的半导体互联网生态公司。目前,我们已成功打造了智能汽车、智能家居、大健康医疗、机器人和材料等五大生态领域。更为重要的是...详细>>

我们深知加工与定制类服务商的价值和重要性,因此,我们倾力为您提供最顶尖的营销资源。在我们的平台上,您可以直接接触到100万的研发工程师和采购工程师,以及10万的活跃客户群体...详细>>

凭借我们强大的专业流量和尖端的互联网数字营销技术,我们承诺为原厂提供免费的产品资料推广服务。无论是最新的资讯、技术动态还是创新产品,都可以通过我们的平台迅速传达给目标客户...详细>>

我们不止于将线索转化为潜在客户。葫芦芯平台致力于形成业务闭环,从引流、宣传到最终销售,全程跟进,确保每一个potential lead都得到妥善处理,从而大幅提高转化率。不仅如此...详细>>