面向Google编程CHARLES ZHANG

AI DAILY / 2026-09-25

Claude Opus 5.5与GPT-6 Sol/Luna齐发:新一轮大模型价格战

Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war

上下文与记忆Simon Willison · 2026-09-22

中文翻译 · AI 生成,仅供学习交流

Claude Opus 5.5、GPT-6 Sol、GPT-6 Luna,以及一场新的价格战

昨天是 Grok 4.7(鹈鹕图)和 MiMo v2.6 Flash/Pro(又是鹈鹕图)。(译注:作者有项招牌测试,就是让模型画「鹈鹕骑自行车」的 SVG。)今天 Anthropic 发布了 Claude Opus 5.5,约一小时后 OpenAI 紧接着发布了 GPT-6 Sol 和 GPT-6 Luna。要把这些新模型都摸透还需要一段时间,下面是我目前的初步印象。

GPT-6 Sol 和 Luna 的定价只有对应 GPT-5.6 版本的一半。GPT-5.6 Luna 已经是我用来构建应用时最喜欢的模型,因为它性能出色还特别便宜。GPT-6 Luna 又把价格砍了一半,GPT-6 Sol 相比 GPT-5.6 Sol 也有类似的降幅。下面是当前的价格格局:

| 模型 | 输入(Input) | 缓存输入(Cached input) | 输出(Output) |
| --- | --- | --- | --- |
| GPT-6 Luna | $0.10/M | $0.01/M | $0.50/M |
| GPT-5.6 Luna | $0.20/M | $0.02/M | $1.20/M |
| Grok 4.7 | $2/M | $0.50/M | $6/M |
| GPT-6 Sol | $2/M | $0.20/M | $10/M |
| GPT-5.6 Terra | $2/M | $0.20/M | $12/M |
| Claude Opus 5.5 | $4/M | $0.20/M | $20/M |
| GPT-5.6 Sol | $4/M | $0.40/M | $20/M |
| Claude Fable 5.1 | $10/M | $0.25/M | $50/M |
| GPT-6 Astra | $10/M | $1/M | $50/M |注意 GPT-5.6 计划在十一月涨价 25%,所以 GPT-6 的价格实际只有那些模型促销价的一半。(GPT-5.6 Terra 现在和 GPT-6 Sol 同价,再继续用 Terra 的理由彻底没了。)

这种价格有多卷,怎么形容都不为过。Grok 4.7 当时定价 $2/$6,本来就不到 GPT-5.6 Sol 的一半。现在它的输入价和 GPT-6 Sol 持平,输出价也相去不远。以 $0.10/$0.50 的定价,GPT-6 Luna 是 OpenAI 历来最便宜的模型之一,只有远不如它的 GPT-4.1 Nano($0.10/$0.40,2025 年 4 月)和 GPT-5 Nano($0.05/$0.40,2025 年 8 月)比它更便宜。

我用 GPT-6 Luna 和 GPT-6 Sol 各渲染了一组鹈鹕图,然后把它们和 GPT-5.6 的鹈鹕图汇总到一张对比网格里。一眼就能看出,5.6 系列选的是更大胆、更鲜艳的配色,6 系列明显更素雅。我还是觉得 GPT-6 Astra 在 max 模式下产出了最好的鹈鹕图。

Claude Opus 5.5 也降价了

Opus 5.5 看起来解决了大家之前对 Opus 最大的吐槽,也就是沟通风格的问题。

Thariq Shihipar 说,Opus 5.5 是根据你们的反馈做出来的。它沟通清晰,每个 token 的价格比 Opus 5.0 更便宜,智能程度比肩 Fable 5.1,token 用得非常高效,而且支持所有 effort 等级(effort level)。Blender 上的表现也会更好。我已经迫不及待想在这上面好好跑一轮测试了。

Opus 4.5、4.6、4.7、4.8 和 5 的定价都一样,输入 $5/百万 tokens,输出 $25/百万 tokens。5.5 降价 20%,分别为 $4/百万 和 $20/百万。缓存读取(cache reads)价格下降了 60%。这对较长的智能体对话(agentic conversations)意义重大,因为其中 90% 以上的输入 tokens 都是按缓存价计算的。

Opus 5.5 的新价和 GPT-5.6 Sol 原本的价格持平,但那是 OpenAI 把 Sol 系列砍半之前的事了。GPT-6 Astra 和 Claude Fable 5.1 都是输入 $10/百万、输出 $50/百万。这场价格战目前波及的是再往下一档的模型。Anthropic 说 Sonnet 5.5 和 Haiku 5.5 即将发布。值得一看的是 Haiku 能否在低端重新夺回价格优势,毕竟现在 Haiku 4.5 还是 $1/$5,而最新的 GPT-6 Luna 只有它的十分之一,即 $0.10/$0.50。

Claude Opus 5.5 max 想得太多,想到崩溃

在我那个「生成一张鹈鹕骑自行车的 SVG」测试里,Claude Opus 5.5 在 max 思考等级下居然没能返回结果,这还是头一次。它一开始把这个请求称为「一个经典的测试请求」,然后就开始非常、非常认真地思考自己在做什么:

> 这是一个经典的测试请求,所以我想规划一只构图完整的鹈鹕,带上它标志性的喙和喉囊,骑在一辆有完整车轮、车架和踏板的自行车上,背景配上简单的天空和地面。[...]
>
> 校验小腿长度约为 95.2,差不多就这样。现在我在画近侧腿的路径,从髋部到膝盖再到脚踝,然后勾勒搭在踏板上的脚部轮廓,用直线和曲线把脚后跟、脚趾尖和脚底轮廓画出来,使其在 y=478–494 附近自然贴合踏板表面。[...]
>
> 我挺喜欢那条从篮子里探出来、鹈鹕盯着看的鱼,这是一个值得保留的小趣味。我也在确认眼睛在喙根附近的位置符合典型的鹈鹕解剖结构,并考虑给它稍微开朗一点的表情。[...]
>
> 远侧腿看上去正确地穿过了车架后方,所以我接下来检查齿盘的齿,并确认图层顺序。远侧的曲柄应当大部分被座管和齿盘遮挡。我正在敲定最终 SVG 的 width 和 height 属性以及 viewBox,以保证缩放正常,因为没有文字,所以也不需要 font-family。[...]

我本来看这只鹈鹕看得兴奋不已,结果它就这么停了。Opus 5.5 有 128,000 的最大输出 token 上限,其他 Claude 模型也一样,而它在推理这张 SVG 的时候就把额度用完了。我又试了一次,结果还是一样。这让我怀疑「max」实际上根本没法用。如果它在一条愚蠢的 SVG 提示上都能想到崩溃,那我不相信它在做更有意思的工作时不会重蹈覆辙。(这两次失败每次花了我 $2.56,耗时近 20 分钟。)

Fable 5.1 在 max 模式下没有过度思考,给了我见过的任何 Anthropic 模型中最好的一张鹈鹕图。下面是 Opus 5.5 的鹈鹕图,不含 5.5 max。我还做了这张