Codex 越来越拉了
Tibo 宣布 28 天连续改进,首日只是把 GPT-6 Astra 与 6.1 Sol 提速 50%。SemiAnalysis 研报指出,Claude 订阅给开发者的等效 API 价值是 OpenAI 的五倍以上。作者从心流讲起,拆解额度腰斩与两家自救路线的差异。

最近 OpenAI 总想搞大新闻,掩盖模型不如 A 社,速度巨慢,消耗极快的事实
Tibo 发推要开启为期 28 天的连续改进挑战,无改进就重置,而在 Day 1 拿出的是:将 GPT-6 Astra 与 GPT-6.1 Sol 的默认推理速度全线拉升 50%,两小时内全部生效!包括通过 Sign in with ChatGPT 接入的所有生态伙伴,像 Devin、OpenCode、Amp、Pi 全都在提速名单里
就在 Tibo 发帖的前几个小时,华尔街与硅谷顶级半导体分析机构 SemiAnalysis 刚刚发布了一份深度研报《Anthropic Subscriptions Offer 5x+ More Value Than OpenAI》,直接把 OpenAI 底裤都给扒了个精光:在实际工作负载下,Claude 订阅计划给开发者带来的等效 API 价值,足足是 OpenAI 的 5 倍以上
在 AI 编程的真实战场上,最值钱的永远不是某个模型的单次智商峰值,是开发者的心流(Flow)
当你在 Cursor、OpenCode 或者终端里全神贯注地重构一个模块时,你脑子里的逻辑架构正在飞速运转,这时候如果模型卡壳,每隔几秒才挤出两个变量名,你的专注力就会被当场腰斩
有网友做过测试,对比GPT 6.1 Sol、Gemini 3.8 Flash、Claude Opus 5.5相同任务的吞吐速度
结果:
| 参赛选手 | 任务总耗时 | 实际吐字速度 |
|---|---|---|
| 🏎️ Claude Opus 5.5 | 88.12 秒 | 71.5 TPS |
| 🏎️ Gemini 3.8 Flash | 185.34 秒 | 239.1 TPS |
| 🚜 GPT 6.1 Sol | 317.95 秒+ | 20.1 TPS |
很多不经常写代码的同学看到这里可能会纳闷:
Gemini 3.8 Flash 吐字速度高达 239.1 TPS,比 Opus 5.5 快了三倍多,怎么耗时反而多了近一倍?
这就是 Agent 任务规划与思维密度的本质差异!Gemini 3.8 Flash 爆发力极猛,像个机关枪一样疯狂输出长篇大论,把整个推演链路拉得极长,总 Token 堆得像山一样;而 Opus 5.5 凭借极其毒辣的架构判断,直切要害,只用最精炼的高信噪比代码完成闭环,因此即便速度是 71.5 TPS,也能在 88 秒内干脆利落地交卷
但最惨的当属 GPT-6.1 Sol
20.1 TPS 是什么概念?一个普通的 Python 脚本通常需要几百到上千 Token 的输出,这意味着每按一次确认,你就得坐在屏幕前盯着光标干等好几分钟,哪怕你起身去接杯水、去趟洗手间,回来它还在慢悠悠地吐着字!
“Sol 的智商确实能够应付日常编码,Token 消耗也只要 Astra 的五分之一,但是慢到让人想摔键盘!我的思路高度连贯,结果等它吐完一段代码,我已经完全忘记上一层函数的传参规则了”
甚至为了对抗这种令人发指的龟速,被逼疯的工程师们硬生生自研出了一套“穷人版三层 Agent 架构”:

为什么大家不敢全量上 Astra?
因为 Astra 消耗配额的速度就像在烧干柴!OpenAI 的周配额只要一碰 Astra,两天内就会直接见底
在这种极度内耗的体验下,大量原本扎根在 Codex 的开发者,开始成群结队地迁移到 Claude Opus 5.5 的阵营
大家原本以为这只是模型速度的暂时波动,直到 SemiAnalysis 的研报出炉,所有人才恍然大悟:背后其实是 OpenAI 算力告急后的算盘调整!这是一场把 AI 巨头逼到悬崖边缘的算力经济学生死战
1. 订阅套餐:占 10% 营收,却吃掉 40% 算力的吞金兽
过去大家总觉得包月 200 美元很贵,但对于重度开发者而言,这笔买卖简直是占尽了巨头的算力便宜!

SemiAnalysis 的 Token 经济学财务模型测算显示:
订阅收入虽然只占 Anthropic 总营收的 10% 左右,但由于高频调用、长上下文缓存与无休止的 Agent 循环,订阅用户吃掉了超过 40% 的全网推理算力!
这种极度不均衡的倒挂,直接把数据中心每兆瓦算力的综合收入拉低了整整 3,600 万美元
面对如此凶猛的算力失血,OpenAI 与 Anthropic 在应对策略上,走出了两条截然相反的分水岭道路
2. OpenAI 的“核打击式硬着陆”:额度腰斩与逼氪 500 刀
面对算力窟窿,OpenAI 的刀法极其决绝:
全新上线了每月 500 美元的至尊套餐,主打的就是 300 TPS 的 Ultrafast 超高速通道;紧接着,原本最受开发者青睐的 200 美元套餐,配额居然被全线腰斩了 50%!


阴谋论点,OpenAI 故意把默认的 Sol 压制在 20 TPS 龟速,再腰斩配额,把高速通道包装成每月 500 美元的奢侈品单独售卖!

3. 两种截然不同的自救路线与 5 倍价值碾压


对比两家的策略,差异更明显:
- OpenAI 选了一刀切的核选项:直接把订阅额度砍到骨折,全面收缩亏损
- Anthropic 选了精细化梯度补贴:针对顶级模型 Fable 5.1 严防死守,但在最关键的编程生产力工具 Opus 5.5 上,依然给出了惊人的慷慨补贴!

数据不会说谎,看上面这张归一化对比图:
在每美元等效 API 价值的对决中,Claude Opus 5.5 的综合收益达到了 OpenAI 的整整 4 到 5 倍!
过去独立开发者们总夸赞 OpenAI 额度给得大方,甚至逼得 Anthropic 几次三番撤回缩减计划;但风水轮流转,到了今天,OpenAI 在开发者心中的性价比神话已经彻底瓦解
“从 20 TPS 提速到 30 TPS,就好比把自行车换成了电瓶车,可隔壁的 Claude Opus 5.5 天生就是开保时捷的;更何况人家一个 200 美元套餐顶你五个,你这边还把额度砍掉了一半,这道算术题小学生都会算”
Codex 如果还靠重置这种小聪明维持口碑,模型能力依然被A家压着打,更别提还有谷歌的追赶,那真就会越来越拉了
就我目前使用体验,Gemini 3.8 Flash 又快又好,偶尔还能蹭蹭 Opus 5.5,已接是绝佳选择了
赚到了,Gemini 4 发布,又高又硬!碾压GPT-6 Astra、Claude Opus 5.5!
我的 Gemini 终于要回本了,开发了一个 macOS 原生客户端,已开源!

作者:Ai学习的老章 公众号:Ai学习的老章
本文由 @Ai学习的老章 原创发布于人人都是产品经理。未经作者许可,禁止转载
题图来自 Unsplash,基于CC0协议
- 目前还没评论,等你发挥!

起点课堂会员权益



