AI按斤卖:Opus降四成、GPT-6减半,我看懂的信号
一、同一天,两份降价通知
9月24日这天有点意思。Anthropic发布Claude Opus 5.5,OpenAI
一、同一天,两份降价通知
9月24日这天有点意思。Anthropic发布Claude Opus 5.5,OpenAI跟进上线GPT-6 Sol和Luna——两家前后脚,主打的都是同一件事:便宜。
Opus 5.5的输入输出价格是每百万Token 4美元和20美元,官方口径是典型工作负载的实际花费比Opus 5少40%;OpenAI更直接,GPT-6 Sol和Luna的API定价较5.6系列直接砍半,Luna的输入价格甚至低于DeepSeek-V4.1 Flash。
我刷到这串数字的第一反应不是「又降价了」,而是想起一周前Dario Amodei还在喊「行业要踩刹车」。刹车没看到,油门先降了价。
二、便宜不等于缩水,这次账本很硬
先看Anthropic这份账。Opus 5.5在Terminal-Bench 4.0拿下66.4%,比自家的Fable 5.1高出10个多点,AA综合智能指数58分排第一;德勤在代码审查里测它,最低努力档就能找出72%的已知bug,而Opus 5开最高档才56%。澳洲数据公司Quantium更具体:一个复杂编码任务,原来要38轮提示跨4天,现在11轮3小时干完。
再看OpenAI。Sol在Agents' Last Exam拿56.4%,超过Claude Opus 5,成本还低60%,事实错误率约为上一代一半;缓存命中输入享受90%折扣,调整推理档位不再打断缓存。Luna更夸张,高档推理的表现对齐GPT-5.6 Sol,成本只有它的百分之一。
这两份账本放一起看,指向同一个事实:前沿能力正在从旗舰档快速下沉到廉价档。一年前要动用最贵模型才能干的活,现在十分之一的价格就能跑起来。
三、为什么降?我的判断
有人说这是价格战,是烧钱抢市场。我的判断不完全一样:这是Agent时代的单位经济学倒逼出来的定价。
原因很简单:模型的用法变了。一问一答聊十轮的时代,API贵点用户忍了;但现在模型要干的是无人值守连跑几小时的长任务——Codex挂一晚上改代码、智能体自己拆解几百步流程——每个环节都在烧Token,累计起来就是天文数字。价格不降到「跑得起」的量级,Agent这条路就堵死了。
所以降价的本质不是让利,是把Agent的燃料费打下来。谁先把单位成本压到对手打不动,谁就能吃下Agent时代的开发者。这也是为什么缓存折扣、回复更简短这些「抠门」优化会被写进发布说明——省Token就是省钱。
四、国产模型怎么办
Luna输入价格低于DeepSeek-V4.1 Flash这条,值得单独说。过去一年国产模型最大的护城河就是极致性价比,现在国际大厂开始正面打这张牌,压力是实打实的。
但我不觉得这是坏消息。一是国内有场景纵深,端侧、政务、制造业这些生态位不是光靠低价能拿下的;二是国产团队卷架构效率的速度并不慢——价格战打到深处,比的其实是每瓦性能和工程化能力,这块中国团队不虚。
五、结尾
我的判断放在这:这轮降价不是周期性促销,而是AI商业模式的分水岭——从「按次卖对话」转向「按量卖劳动力」。跑出来没问题的话,明年这个时候我们聊的就不是模型多聪明,而是一个Agent月费能顶几个实习生。
你手头的活里,有多少已经可以按「Token工资」外包给模型了?评论区聊聊。
来源:TechMarketView/腾讯研究院AI速递 2026-09-25