Cloudflare 于10月1日发布无服务器数据平台 Cloudflare Basin,把数据分析工作负载纳入其全球网络,面向中小企业和开发者团队提供数据摄取、存储、编目与查询能力。据 SiliconANGLE 报道,Cloudflare 将这一产品定位为无需自建专用数据基础设施的替代方案。

Cloudflare 介绍,Basin 基于开源 Apache Iceberg 表格式构建,底层使用公司自有的 R2 分布式对象存储,该存储不收取数据出口费用。由于 Iceberg 支持 Apache Spark、DuckDB 等分析引擎在数据原地直接读取,客户不需要复制数据、迁移文件或转换格式,数据收集、准备和分析环节都运行在 Cloudflare 的全球网络上,被提取的只是查询时产生的分析结果。

按 Cloudflare 的说法,数据分析向来门槛不低。企业要配备有经验的数据工程师,负责搭建和维护存储、组织数据的服务器系统,还要把不同系统拼接起来,构建数据管道,才能把待分析的信息送入分析引擎。这些工作成本高昂,仅把数据从公有云迁到另一套系统就要支付高额出口费用,再加上人员薪酬和系统开销,通常只有规模最大的组织才跑得起复杂的数据分析,并借此获得对小型竞争对手的优势。

Basin 的定价方式相应简化,客户按所分析的数据量付费。Cloudflare 首席技术官 Dane Knecht 表示,软件开发者不应该为了查询自己的信息而去学习如何运维数据基础设施。“通过 Cloudflare Basin,我们把开发者期望从 Cloudflare 获得的无服务器模式带到了分析领域,”他说,“没有需要管理的集群,没有不必要的数据移动,开放标准让客户始终掌控自己的数据。”

Constellation Research 的 Michael Ni 认为,Cloudflare 是在利用 Apache Iceberg 数据栈的经济性,该数据栈让存储与计算更具可互换性。“Cloudflare 已经拥有全球基础设施、无服务器计算和无出口费用的存储模式,”他说,“而且它本身就处在大量应用、日志和事件数据的传输路径上,这大幅降低了它的数据移动成本。”

这一动作把 Cloudflare 带入 Snowflake 和 Databricks 等数据仓库厂商的竞争范围。Cloudflare 以内容分发网络和网络安全产品为人熟知,近年则持续扩大边缘计算布局,试图借助高度互联的全球网络让企业在数据产生地附近完成分析,绕开集中式云数据仓库以降低延迟和成本。Cloudflare 也承认 Basin 不会全面取代各类数据仓库负载,但认为分析市场仍存在可观机会:许多分析任务的规模太小,不足以支撑专用服务器集群和数据搬运的开支,而 Basin 可能改变这一局面。Ni 表示,他不认为大公司会很快弃用 Databricks 或 Snowflake,但 Cloudflare 有机会先承接传统数据仓库市场边缘的负载,再沿技术栈向上延伸。