从内存数据库走向云原生数据底座,深入理解 SAP HANA Cloud
很多熟悉 SAP HANA On-Premise 的技术人员第一次接触 SAP HANA Cloud 时,脑海里很容易形成一个直觉判断,SAP 只是把原来安装在企业数据中心里的 HANA 搬到了云端,再由 SAP 帮忙维护。
这个理解只对了一小部分。
如果今天重新审视 SAP 官方对 SAP HANA Cloud 的产品定位,会看到一个比传统托管数据库更大的技术边界。SAP HANA Cloud 被定义成面向关键业务应用和实时分析的 Database as a Service,也就是 DBaaS。它既保留了 SAP HANA 擅长的内存计算、列式存储和实时分析能力,又把关系数据、图数据、空间数据、向量数据以及半结构化数据放到了同一套数据库技术体系中,同时加入弹性伸缩、自动软件更新、多层存储、数据虚拟化以及面向云环境的生命周期管理能力。SAP 当前的 Getting Started Guide 仍然明确把它描述为一个能够在 PB 级规模下支撑关键业务应用和实时分析的云原生数据库服务。
理解 SAP HANA Cloud 时,我更愿意把关注点从云上的 HANA 转向企业数据运行底座。这个视角一旦建立起来,很多功能为什么会出现在 SAP HANA Cloud 中,也就容易理解了。
传统数据库讨论的核心往往是表、索引、事务、SQL 和存储,而今天企业的数据形态已经发生很大变化。ERP 系统里存在结构化订单数据,CRM 里存在客户关系,IoT 系统不断产生设备坐标和时间序列,业务文档大量以 JSON 存在,知识库里又可能保存文本 Embedding。企业真正面对的问题已经不是能不能保存一张表,而是这些不同形态的数据能不能在同一个业务语境里被实时访问和计算。
SAP HANA Cloud 正是沿着这条
