如何定义一款“爆款”模型?从正式发布到显示“售罄”,仅仅用了8天时间。
9月11日早间消息,OpenAI首席产品官Tibo今早在X平台上发文表示,为了确保现有用户能够获得良好体验并顺畅访问GPT-6 Astra,将暂停接受每月200美元档位的Pro 20X订阅服务的新增订阅。
事实上,9月9日,Tibo已在社交平台上发出预警:“人们对Astra的需求前所未有,我们正在动用所有能用的杠杆……如果这种情况持续下去,我们可能不得不暂停新的Pro订阅。”Sam Altman当时回应称,这种情况“会很糟糕”,但OpenAI会优先保障现有付费用户的服务质量。
而现在距离9月3日OpenAI发布GPT-6 Astra,也不过八天时间。官方直接以“AGI时代”为其定调,称其在长链条自主推理、复杂代码编写与自动化任务推进上的表现显著提升。
随后,开发者社区迅速引发剧烈震动,甚至在大规模工程测试中短时间内吸引了大量原本属于Anthropic的核心用户。
截至发稿时,订阅页面上的Pro选项仅剩下每月100美元的5X档位。Tibo解释称,Pro订阅对系统造成的压力最大,暂停新增是“影响最小的办法”;OpenAI未给出恢复时间,仅表示正以尽可能快的速度增加容量。
龙虾创始人Peter Steinberger等开发者随即在社区提醒“最好赶紧订阅”,也有不少开发者对顶级AI公司在核心产品上限流表达了不满。
最先售罄的是最贵档位。在OpenAI现有付费体系中,Pro 20X虽然总价最高、用户数最少,却是单位算力折扣最大、使用率最高的一档:从Pro 5X升级到20X,用户多付一倍的钱可换取四倍额度,还包含无限桌面语音等权益。Pro 5X的Astra周额度为50条,Pro 20X则为200条。
SemiAnalysis的测算进一步揭示了这一档位的财务压力:将各档订阅跑到周限额耗尽,再按标准API价格折算,OpenAI在Plus和Pro 5X上使用率超过11.4%就开始亏钱,而Pro 20X只要5.7%的使用率就进入负毛利,Anthropic对应的数字约为10%。
换言之,“Coding Plan”的定价隐含着“多数人不会用满”的假设,Pro 20X用户却是恰恰会把它用完的人——整夜运行Codex、跑长链路Agent、一天派发上百个任务的重度开发者。这其中自然也包括基于被路由器和中间站分流的用户。
Astra按量计费标准约为上一代GPT-5.6 Sol的2.5倍,进一步放大了单位推理成本,重度用户的真实使用行为击穿了原有的商业模型假设。
当然,这其中也不乏开发者抱怨Astra本身就存在“过度”消耗Token的嫌疑。
有Plus用户称,Astra跑半小时左右就能耗掉整周额度;也有人报告单个任务就撞上5小时限制。Tibo前一天刚把重度场景的订阅额度消耗最多压低到原来的约1/3至1/4,现在又直接补了一次全局重置。
就在昨天,OpenAI已经给所有付费订阅统一重置一次使用额度。核心产品负责人Tibo Sottiaux称,目的是让已经把额度用光的用户继续跑GPT-6 Astra。
暂停订阅的直接原因,是GPT-6 Astra上线后推理需求的指数级增长撞上了相对刚性的算力供给。《纽约时报》曾报道,OpenAI预计到2030年累计云计算和算力相关支出将达约7500亿美元,较此前约6000亿美元的预测上调约25%,且公司明确承认目前仍“非常缺乏”计算能力。
OpenAI的算力供给是典型的多供应商结构,Oracle是当前最大的单一供给方。2025年9月,OpenAI与Oracle确认签署了一份为期约五年、价值约3000亿美元的云计算合同,Oracle将建设4.5吉瓦的数据中心容量供OpenAI按年采购,相当于两个胡佛大坝的发电量、约400万美国家庭的用电量。
旗舰站点位于得克萨斯州阿比林的Stargate,双方共同部署的OCI Zettascale10集群可支持多达80万颗NVIDIA GPU。
此外,OpenAI与AWS签有约1380亿美元的长期合作协议,微软Azure则是其历史悠久的算力底座。
但合同签得再多,落地节奏是另一回事。Stargate的4.5吉瓦容量需逐年交付,山茶花项目(Project Camellia)在佐治亚州规划的3.2吉瓦电力要到2028至2032年才分阶段到位。
为摆脱对英伟达GPU的依赖、降低单位推理成本,OpenAI已经与博通达成了10吉瓦定制加速器合作,自研芯片Jalapeño(墨西哥辣椒)计划从今年年底开始部署,但距离规模化供应仍有窗口期。
换句话说,OpenAI远期虽有天文数字的合同保底,但近期算力吃紧也的确是窘境的写照。
随着顶尖模型能力持续提升,无论是订阅价格还是限流措施,进一步收紧恐怕都难以避免。用户若想了解更详细的技术动态,可参考爱游戏网页版入口上的相关解读。本文来自微信公众号“AI前线”,作者:青和,36氪经授权发布。