在下一个模型发布之前

0 评论 850 浏览 0 收藏 11 分钟

Kimi K3 的横空出世再次印证了 AI 模型迭代的残酷法则。这款国产大模型不仅引发美股 AI 板块单周蒸发 4700 亿美元,更在性能评测中直逼 Claude 与 GPT 系列,迫使海外巨头紧急调整产品策略。当算力紧缺与 Token 效率问题交织,这场由模型性能主导的产业洗牌正以周为单位加速演进。本文深度剖析 Kimi 现象背后的技术博弈与市场逻辑。

像所有 AI 行业人士一样,月之暗面创始人杨植麟喜欢用“AI 一天,人间一年”的说法形容 AI 的迅速迭代。对于刚刚发布的 Kimi K3 而言,似乎没有什么形容比这句话更为贴切。月之暗面成立至今已有三年,但过去三年的所有积累可能都抵不上这三天的轰动。

自 ChatGPT 发布以来,中国 AI 行业有许多次震惊世界的时刻。一部分来自于真正的技术突破,一部分则是媒体与厂商们的自嗨,Kimi K3 的发布似乎是唯一能与“DeepSeek 时刻”相媲美的。

和去年年初 DeepSeek-R1 发布后美国芯片产业普跌类似,上周包括英伟达、博通以及美光在内的费城半导体指数重挫 10%,创下自 2025 年 4 月以来最大单周跌幅,进入技术性熊市区间。媒体统计称,72 小时内美股 AI 板块合计蒸发 4700 亿美元,约超 3 万亿人民币。

不止一家海外媒体及研究机构用诸如“DeepSeek 2.0”来形容 Kimi K3。《财富》杂志称这是“第二次 DeepSeek 冲击”,《华尔街日报》强调 Kimi 加剧了华尔街芯片股抛售,彭博社则表示“Kimi 颠覆了美国领先中国的传统认知”。

恐慌的情绪不断蔓延,甚至令 OpenAI 及 Anthropic 都备受质疑,因为一家中国开源模型的性能似乎已接近顶级闭源模型。二者本就处在上市前的关键节点,模型性能领先是他们获得高估值以及高定价的关键。部分美国开发者已经在质疑为何还要为 Claude 和 GPT 付出这么多的价格。

过去几日,Anthropic 宣布为所有 Max 及 Team Premium 用户开放 Claude Fable 5,但限额 50%,此前他们曾因算力问题而计划完全从订阅方案中移除这一模型。OpenAI 则在上周多次重置 Codex 限额,甚至一度取消了 5 小时的用量限制。

很难说这些事件都是 Kimi K3 的冲击所致。在此之前,半导体产业已经连续承压数周,华尔街分析师们迫切需要为这轮下跌寻找一个足够醒目、也容易理解的借口——境外势力自然是万能法宝。更不用说 OpenAI 及 Anthropic 本就处在激烈竞争之中,已经演变到大打价格战的地步。

但这似乎并不影响美国科技行业对于 Kimi K3 的惊讶。即便 Kimi 承认自身总体性能仍落后于 Claude Fable 5 于 GPT-5.6 Sol,诸多海外评测机构仍在测评对 K3 不吝赞美,排名往往位列前茅。

Arena.ai 称 Kimi K3 以 1679 分的成绩获得前端代码竞技场榜首,超越 Claude Fable 5。这家机构表示,上次中国模型如此接近领先,还是 2025 年的 DeepSeek-R1。

Arena 统计中美 AI 对比

高昂的市场热情下,连杨植麟都成为美国科技圈热议的新偶像人物。大洋彼岸的人民群众疑问为何他当年没有留在美国,而是回到了中国。杨植麟的博士生导师不得不专门发文解释,澄清杨回国并不是由于签证或移民问题,而是他自己坚定要回去创业。

大模型行业仍然遵循着最简单明了的优胜劣汰法则,只要性能足够领先,价格就不是问题。即便 K3 模型的输入及输出价格均较上代 K2.6 模型均上涨超 3 倍有余,也显著高于 GLM-5.2 及 DeepSeek V4 Pro,已经是目前市面上最贵的国产模型,但 Kimi 依然遭遇了算力紧缺问题。

7 月 19 日晚,Kimi 宣布由于算力紧缺,自即日起暂停 C 端新用户订阅。他们同时调整了会员权益,将原本覆盖 Kimi 网页版、App 以及 Kimi Work 的通用会员与 Kimi Code 会员拆分销售。Kimi 总裁张予彤称,K3 发布次日公司 ARR 创下历史最大单日增幅。

Kimi 官方推文

算力紧缺一定程度上或许也与 K3 模型自身的 Token 效率相关。在 Artificial Analysis 的评测中,K3 完成整套测试输出了 1.3 亿个 Token,接近同类模型平均水平的两倍。更长的输出通常意味着更高的推理成本,这可能进一步加重 Kimi 的算力压力。

社交媒体上,也有不少开发者吐槽 Kimi K3 是 Token 消耗大户,有人称跑了 15 分钟就已经耗尽了 5 小时的限额。

K3 的出圈似乎再一次证明了 AI 时代模型的脆弱性。仅仅两周之前,中国大模型市场最被人看好的还是已经上市的智谱。上半年智谱发布的 GLM-5.2 模型被誉为国产开源模型的骄傲,几次大幅上调价格依然紧俏。上市半年来,智谱股价翻了 24 倍有余,总市值一度突破 1.3 万亿港元。

但从上周开始,智谱的神话似乎就已松动。上周五,智谱股价下跌 28.49%,本周一再跌 19.56%,两个交易日股价累计下跌超 4 成,市值跌破 5000 亿港元。

Kimi K3 的领先可能也维持不了多久。7 月 19 日,阿里巴巴发布 Qwen3.8 Max 预览版,参数规模达 2.4 万亿,宣称综合能力在全球范围内仅次于 Claude Fable 5。马斯克对外称,拥有 2 万亿参数量的 Grok 新模型即将完成初步训练,它可能在保持较高运行效率的同时超越 Kimi。

K3 发布当天,萨姆·奥尔特曼对外表示,他知道他们过去 12 个月并非最佳,这主要归咎于他,但他们即将迎来迄今为止最好的 12 个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”

芯片行业多年来一直奉行着摩尔定律,在成本大致不变的情况下芯片性能大约每 18 至 24 个月翻一倍。但就像 AI 行业人士常常挂在嘴边的“AI 一天,人间一年”的说法,AI 时代的模型性能提升可能以周甚至天来计算。

去年谷歌的 Gemini 模型一度令萨姆·奥尔特曼在公司内拉响红色警报,但现在 Gemini 更流行的称谓是“北美豆包”。彭博社称 Gemini 3.5 Pro 的发布时间已经推迟数月,因为模型在编程及代码生成能力上未达预期。

两个交易日的重挫后,市场消息称智谱可能跳过 GLM-5.3,直接推出 GLM-5.5,预计最快将于 8 月发布,据称将具备万亿以上的参数规模。智谱的员工们已经开始在推特上放出小道消息,称现在可能是订阅 GLM Coding Plan 的最佳时机。

刚刚完成首轮融资的 DeepSeek 被曝即将推出 DeepSeek-V4 模型的正式版,外界称性能将逼近 GPT-5.6,且继续保持极高性价比的优势。

过去的时代总在反复证明时间的重要。无论是 PC 互联网还是移动互联网,一家公司只要起步足够早、跑得足够快,就有机会赶在窗口关闭前建立先发优势。而随着用户和市场规模不断扩大,领先非但不会被稀释,反而会持续放大,令后来者越来越难以追赶。

但在 AI 时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短与前者的差距。如果说互联网时代最难追赶的是规模,那么 AI 最醒目的优势就是模型。只是这种优势的保质期,往往只有一个版本。

两个交易日内股价连跌 4 成的智谱,今日盘中涨幅一度超 35%。市场消息称,智谱已落地 1GW 级国产 AI 算力数据中心建设。

竞争仍在继续。

作者 I 薛星星  编辑 I 蒋浇

本文由人人都是产品经理作者【山上】,微信公众号:【山上】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图由作者提供

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
评论
评论请登录
  1. 目前还没评论,等你发挥!