Codex 越来越拉了

0 评论 501 浏览 0 收藏 10 分钟

Tibo 宣布 28 天连续改进,首日只是把 GPT-6 Astra 与 6.1 Sol 提速 50%。SemiAnalysis 研报指出,Claude 订阅给开发者的等效 API 价值是 OpenAI 的五倍以上。作者从心流讲起,拆解额度腰斩与两家自救路线的差异。

最近 OpenAI 总想搞大新闻,掩盖模型不如 A 社,速度巨慢,消耗极快的事实

Tibo 发推要开启为期 28 天的连续改进挑战,无改进就重置,而在 Day 1 拿出的是:将 GPT-6 Astra 与 GPT-6.1 Sol 的默认推理速度全线拉升 50%,两小时内全部生效!包括通过 Sign in with ChatGPT 接入的所有生态伙伴,像 Devin、OpenCode、Amp、Pi 全都在提速名单里

就在 Tibo 发帖的前几个小时,华尔街与硅谷顶级半导体分析机构 SemiAnalysis 刚刚发布了一份深度研报《Anthropic Subscriptions Offer 5x+ More Value Than OpenAI》,直接把 OpenAI 底裤都给扒了个精光:在实际工作负载下,Claude 订阅计划给开发者带来的等效 API 价值,足足是 OpenAI 的 5 倍以上

在 AI 编程的真实战场上,最值钱的永远不是某个模型的单次智商峰值,是开发者的心流(Flow)

当你在 Cursor、OpenCode 或者终端里全神贯注地重构一个模块时,你脑子里的逻辑架构正在飞速运转,这时候如果模型卡壳,每隔几秒才挤出两个变量名,你的专注力就会被当场腰斩

有网友做过测试,对比GPT 6.1 Sol、Gemini 3.8 Flash、Claude Opus 5.5相同任务的吞吐速度

结果:

参赛选手 任务总耗时 实际吐字速度
🏎️ Claude Opus 5.5 88.12 秒 71.5 TPS
🏎️ Gemini 3.8 Flash 185.34 秒 239.1 TPS
🚜 GPT 6.1 Sol 317.95 秒+ 20.1 TPS

很多不经常写代码的同学看到这里可能会纳闷:

Gemini 3.8 Flash 吐字速度高达 239.1 TPS,比 Opus 5.5 快了三倍多,怎么耗时反而多了近一倍?

这就是 Agent 任务规划与思维密度的本质差异!Gemini 3.8 Flash 爆发力极猛,像个机关枪一样疯狂输出长篇大论,把整个推演链路拉得极长,总 Token 堆得像山一样;而 Opus 5.5 凭借极其毒辣的架构判断,直切要害,只用最精炼的高信噪比代码完成闭环,因此即便速度是 71.5 TPS,也能在 88 秒内干脆利落地交卷

但最惨的当属 GPT-6.1 Sol

20.1 TPS 是什么概念?一个普通的 Python 脚本通常需要几百到上千 Token 的输出,这意味着每按一次确认,你就得坐在屏幕前盯着光标干等好几分钟,哪怕你起身去接杯水、去趟洗手间,回来它还在慢悠悠地吐着字!

“Sol 的智商确实能够应付日常编码,Token 消耗也只要 Astra 的五分之一,但是慢到让人想摔键盘!我的思路高度连贯,结果等它吐完一段代码,我已经完全忘记上一层函数的传参规则了”

甚至为了对抗这种令人发指的龟速,被逼疯的工程师们硬生生自研出了一套“穷人版三层 Agent 架构”:

为什么大家不敢全量上 Astra?

因为 Astra 消耗配额的速度就像在烧干柴!OpenAI 的周配额只要一碰 Astra,两天内就会直接见底

在这种极度内耗的体验下,大量原本扎根在 Codex 的开发者,开始成群结队地迁移到 Claude Opus 5.5 的阵营

大家原本以为这只是模型速度的暂时波动,直到 SemiAnalysis 的研报出炉,所有人才恍然大悟:背后其实是 OpenAI 算力告急后的算盘调整!这是一场把 AI 巨头逼到悬崖边缘的算力经济学生死战

1. 订阅套餐:占 10% 营收,却吃掉 40% 算力的吞金兽

过去大家总觉得包月 200 美元很贵,但对于重度开发者而言,这笔买卖简直是占尽了巨头的算力便宜!

SemiAnalysis 的 Token 经济学财务模型测算显示:

订阅收入虽然只占 Anthropic 总营收的 10% 左右,但由于高频调用、长上下文缓存与无休止的 Agent 循环,订阅用户吃掉了超过 40% 的全网推理算力!

这种极度不均衡的倒挂,直接把数据中心每兆瓦算力的综合收入拉低了整整 3,600 万美元

面对如此凶猛的算力失血,OpenAI 与 Anthropic 在应对策略上,走出了两条截然相反的分水岭道路

2. OpenAI 的“核打击式硬着陆”:额度腰斩与逼氪 500 刀

面对算力窟窿,OpenAI 的刀法极其决绝:

全新上线了每月 500 美元的至尊套餐,主打的就是 300 TPS 的 Ultrafast 超高速通道;紧接着,原本最受开发者青睐的 200 美元套餐,配额居然被全线腰斩了 50%!


阴谋论点,OpenAI 故意把默认的 Sol 压制在 20 TPS 龟速,再腰斩配额,把高速通道包装成每月 500 美元的奢侈品单独售卖!

3. 两种截然不同的自救路线与 5 倍价值碾压


对比两家的策略,差异更明显:

  • OpenAI 选了一刀切的核选项:直接把订阅额度砍到骨折,全面收缩亏损
  • Anthropic 选了精细化梯度补贴:针对顶级模型 Fable 5.1 严防死守,但在最关键的编程生产力工具 Opus 5.5 上,依然给出了惊人的慷慨补贴!

数据不会说谎,看上面这张归一化对比图:

在每美元等效 API 价值的对决中,Claude Opus 5.5 的综合收益达到了 OpenAI 的整整 4 到 5 倍!

过去独立开发者们总夸赞 OpenAI 额度给得大方,甚至逼得 Anthropic 几次三番撤回缩减计划;但风水轮流转,到了今天,OpenAI 在开发者心中的性价比神话已经彻底瓦解

“从 20 TPS 提速到 30 TPS,就好比把自行车换成了电瓶车,可隔壁的 Claude Opus 5.5 天生就是开保时捷的;更何况人家一个 200 美元套餐顶你五个,你这边还把额度砍掉了一半,这道算术题小学生都会算”

Codex 如果还靠重置这种小聪明维持口碑,模型能力依然被A家压着打,更别提还有谷歌的追赶,那真就会越来越拉了

就我目前使用体验,Gemini 3.8 Flash 又快又好,偶尔还能蹭蹭 Opus 5.5,已接是绝佳选择了

赚到了,Gemini 4 发布,又高又硬!碾压GPT-6 Astra、Claude Opus 5.5!

我的 Gemini 终于要回本了,开发了一个 macOS 原生客户端,已开源!

作者:Ai学习的老章 公众号:Ai学习的老章

本文由 @Ai学习的老章 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自 Unsplash,基于CC0协议

更多精彩内容,请关注人人都是产品经理微信公众号或下载App
海报
评论
评论请登录
  1. 目前还没评论,等你发挥!