核心判断

OpenAI 存储系统 Habitat 的规模曝光——每秒 7000 万次请求、500PB 数据、每周 10 亿用户——把 AI 基础设施的"隐形成本"推到台前。它对智算中心与云平台最大的启示是:存储与数据底座,是 AI 规模化绕不开的差异化竞争点;容量规划与技术债治理,必须与算力扩张同步做。

当外界讨论 AI 时,目光往往落在 GPU、大模型参数与推理算力上。但真正支撑 ChatGPT 每周服务 10 亿用户的,不止是算力,还有一套被曝光的后端存储系统——Habitat。它揭示了一个被长期低估的事实:AI 基础设施的账本里,算力只是显性那一行,存储与数据底座才是不断膨胀的"隐形成本"。

一、Habitat 是什么:从连接数微服务到核心存储底座

据公开报道,Habitat 支撑 ChatGPT 的后端存储:每秒 7000 万次请求、500PB 数据、每周 10 亿用户。数字本身已足够惊人,但更值得拆解的,是它的成长路径——Habitat 最初只是一个处理"连接数"的微服务,随着 ChatGPT 规模爆发,才被逐步重构成 OpenAI 的核心存储基础设施。

这条路径的关键词是"演进而非搭建":先满足需求,再逐步重构成规模系统。OpenAI 处理技术债的方式——不在一开始追求完美架构,而是先让业务跑起来,再用规模倒逼重构——对今天所有做大模型与智算基础设施的团队,都有直接参照价值。

二、为什么要重视"隐形成本":存储是 AI 规模化的底座

一个容易被忽略的逻辑是:AI 服务的价值密度越高,对存储与数据层的依赖就越深。训练要喂海量数据,推理要读写上下文与缓存,用户行为要沉淀为资产——每一环都压在存储系统上。ChatGPT 的 500PB 不是静态库存,而是持续增长的活数据。

对基础设施供给方而言,这意味着:谁能在存储架构、容量规划与数据吞吐上做得更稳,谁就越能在 AI 规模化中占据差异化优势。分布式存储的扩展性、高并发下的低延迟、以及面向未来的容量预留,正在成为与 GPU 同等重要的竞争维度。

三、对鹭港智联 / 智算中心的借鉴意义

第一,存储与算力要同步规划,不能只盯着 GPU。智算中心在扩容算力的同时,必须把分布式存储架构、数据吞吐与容量规划纳入同一条建设主线——因为算力跑得再多,数据底座跟不上就是瓶颈。

第二,容量规划要"向前预留"。Habitat 的经验是"先满足、再重构",但对供给方而言更稳妥的策略是:在服务客户规模化之前,就把存储扩展路径与冗余容量设计进架构,避免需求爆发时被动的"救火式重构"。

第三,技术债治理本身也是服务能力。能承接客户从"小规模试水"到"大规模上线"的完整过程,并为存储与数据底座提供持续演进方案,是智算中心与云平台差异化服务的重要组成。

归根结底,Habitat 的曝光给行业提了个醒:AI 的竞赛不只是算力的竞赛,更是整个基础设施——含存储与数据底座——的竞赛。谁把"隐形成本"真正纳入战略,谁就更能在 AI 规模化时代站住脚。

来源标注

本文 Habitat 相关数据(每秒7000万次请求、500PB数据、每周10亿用户、连接数微服务演进路径、技术债治理方式)源自 OSCHINA 公开报道(https://www.oschina.net/news),具体架构细节与数据口径以 OpenAI 官方发布为准。文章分析观点为鹭港智联(鹭港算力)基于公开信息的行业解读。