看到这张截图的时候,相信很多人的第一反应都是:太神奇了,活久见!
作为在互联网行业摸爬滚打的老兵,习惯了SaaS服务和各种移动端应用的无限分发,在我们的认知里,数字商品天生就没有任何库存限制。不管是以前跑 SQL 追踪用户漏斗转化,还是通过各种广告网络(AdMob、Pangle、Meta 等)做 eCPM 商业化优化,传统的软件商业模式都建立在“边际成本趋近于零”的大前提下。
但今天,Kimi(月之暗面)的“登月计划”付费会员页面上,却赫然出现了一个灰色的按钮——“已售罄”。头一次看到纯正的虚拟会员能卖断货,这并非饥饿营销,而是大模型狂飙突进下,极其真实甚至有些残酷的物理约束。
结合外媒和近期的行业动态,这一切都有迹可循。就在几天前的2026年7月16日,月之暗面正式发布了新一代开源大模型 Kimi K3。
这是一个拥有2.8万亿参数、原生支持视觉理解、具备惊人的100万 Token 上下文窗口的庞然大物。它一经发布便引爆了技术圈,甚至在发布几小时后就登顶了业内权威的 AI 代码工具评测榜单 Arena,这也是中国大模型首次在该榜单夺冠。
但极致的技术狂欢立刻撞上了现实的引力。K3 模型在长文本处理和复杂推理上的能力强化,导致单次推理所需的显存大幅增加。官方披露,在模型发布的过去48小时内,激增的用户请求量直接逼近了其现有 GPU 集群的承载极限。
于是,在7月19日晚间,月之暗面被迫发布了《关于算力紧缺与会员暂停开放的说明》。他们做出了一个极其罕见的决定:宣布即日起暂停 C 端新用户订阅,将现有算力全部用于保障已订阅用户的权益,并全速推进扩容。截图里那个充满荒诞感的“已售罄”按钮,正是这一突发状况的直接产物。
为什么顶级大厂也会被“卡脖子”?因为生成式 AI 完全打破了传统的软件经济学规律。
在大模型时代,算力成本不仅无法像传统流量那样被规模化摊平,反而会随着用户的重度使用呈线性增长。仔细看截图里的套餐:连续包月49元,连续包年468元。在古典互联网思维里,这笔买断费很合理。
但我们来算一笔真实的账:以类似 K3 这种擅长长程推理和代码生成的高阶模型为例,如果单次深度对话输入达到了80万 Token,同时输出了约20万 Token,那么单次深度交互的硬核算力成本,粗略估算可能就高达惊人的36元上下(输入约16元 + 输出约20元)。
这意味着什么?一个重度用户支付的49元订阅费,可能只要两三次极限深度的调用,就直接“击穿”了厂商的成本线。这种夸张的成本倒挂,使得大模型公司在未突破算力物理瓶颈之前,根本不敢无限期接纳 C 端重度用户。卖得越多,亏得越狠,甚至还会导致整个底层系统崩溃。
这次 Kimi 会员“售罄”事件不仅是个大新闻,更给所有致力于将 AI 融入各类软件项目(比如多媒体工具、科研教育应用)的开发者们敲响了警钟。算力资源的紧缺绝非 Kimi 一家独有,这是当前乃至未来很长一段时间内,整个 AI 行业的结构性矛盾。
面对这种行业底色的算力焦虑,我们在做产品的底层架构规划时,必须回归长期主义的思考方式:
屏幕上那句略显无奈的“已售罄”,戳破了 AI 算力无限供应的浪漫幻觉。数字世界终于再次迎来了它的物理“稀缺性”。在这个新规则下,只有真正敬畏技术边界、坚持打造稳健架构的团队,才能在漫长的技术周期里笑到最后。
全部评论