刚刚,奥特曼亲自给GPT-5.5起了个外号叫“自闭天才”,一下子就在网上炸开了锅。上线才半个月,他已经在社交平台上多次毫不掩饰地表达兴奋,甚至感慨:真不敢相信,我们居然能造出这样的AI。



按奥特曼自己的说法,GPT-5.5的“原始智能”已经拉开了断档级别的差距——跑分碾压,token省到飞起,性能就是暴力美学拉满。AI圈里不少大佬也直接用脚投票,甚至有AI教授Derya Unutmaz直言,这玩意儿完全可以叫GPT-6。

同一天,一张全网疯传的图表显示,在GPT-5.5的加持下,Codex的下载量在5月直线飙升到8610万,远超Claude Code。光上一周,单周下载量就突破了9000万,是Claude Code的12倍。

开发者的反馈也在疯狂印证这一点。很多人公开表示,在实际编码任务中,GPT-5.5的表现已经超过了Claude Opus 4.7,尤其是token消耗这块。同样的任务,GPT-5.5用的token比Claude少了将近40%。不得不说,“自闭天才”这个比喻精准得让人有点心疼。

16人团队退订Claude,一个月省3.2万美元

一家叫Bold Metrics的初创公司,创始人Morgan Linton发了一条帖子,语气挺平静,但内容很炸裂:正式告别Anthropic。对他们16人的小工程团队来说,Codex加Cursor的组合已经完全取代了原来的方案。

理由简单又粗暴——Claude Code太贵了。相比之下,有GPT-5.5加持的Codex最近表现惊艳,而且token利用率极高,非常省钱。实际工作中,他们团队还是频繁用Cursor做代码审查,但关键是一直没用触发表格限制,内置的Composer 2功能已经能扛住绝大多数开发场景。

针对Claude的token消耗,Linton还算了笔账:每个工程师每月烧掉2000美元以上,16个人就是超过3.2万美元的开销。换成Codex加Cursor之后,GPT-5.5的token效率让成本断崖式下降,性能还不打折。更扎心的是他预测,会有越来越多的工程负责人做出类似的决定。这条帖子像深水炸弹一样,直接炸到了Anthropic的命门上——产品虽好,但token消耗简直是抢钱。

而Codex这边,数据已经给出了答案。一周下载9000万,Codex正在成为神话。TickerTrends数据显示,截至5月3日,Codex下载量达到惊人的8610万次,周环比暴涨1397%。到了5月8日,这个数字进一步攀升到单周9000万。与此同时,Anthropic的Claude Code同期下载量是720万次,周环比反而跌了38%。一个狂飙,一个失血,此消彼长的速度快得让人窒息。

这波增长的引爆点很明确:4月30日Codex发布了v0.128.0版本,引入了持久化的/goal工作流,支持跨会话的多步任务规划。再加上GPT-5.5带来的百万token上下文,以及40%的token效率提升,开发者用脚投票的速度比任何评测都诚实。奥特曼本人也在内部信里用了一个词来形容Codex的增长:疯狂。

微软副总Omar Shahine忍不住称赞,Codex在创建Swift iOS应用上表现非凡,他只用了一个提示,Codex就直接出了应用,解决了95%的工作,比Claude Code好用多了。紧接着,OpenAI开发者体验负责人Romain Huet表示,Codex能设计界面,用GPT-5.5写Swift代码,连Xcode都不用开就能直接在模拟器里跑App,甚至还能用“电脑操控”到处点点点做测试。开发者Dimitris Papailiopoulos同样说,自己明显更信任Codex了。如今有了Codex,奥特曼也说自己时间更自由了。

奥特曼深夜“真心话”,评论区直接失控

同一天,奥特曼开始在线征集意见,问大家最希望OpenAI下一代模型改进什么。评论区瞬间涌爆了。

一条高赞评论把OpenAI直接钉在了墙上。OpenAI前研究员Will Depue的回应当成了全场焦点。他说,GPT-5.5缩小了和Claude的差距,但在“人味儿”上输得一塌糊涂。他举了个例子:当你想学天体物理时,GPT-5.5会立刻甩出一堆冷冰冰的缩写和公式,把你搞得一头雾水;而Claude就像一个博学又优雅的导师,能带你钻进各种知识兔子洞,既有趣又不乱套。他直接喊话,OpenAI的数据调优太机械了,赶紧向Anthropic学习,把模型的“性格”和“解释能力”往回拽30%。全网最强的模型,居然在“像个人”这件事上被人嫌弃了。

还有人希望ChatGPT能提升一下遵循指令和写作的能力。另外,前端是网友们提得最多的,大家都希望这方面能有显著的改进。