Anthropic发布Claude Sonnet 5.5,并把它用作claude.ai免费版模型
Anthropic称新模型运行速度快 30% 以上、大多数任务成本最多降低 30%,定价与Sonnet 5相同,却在各项基准测试上表现更好;免费版claude.ai现在直接跑这个模型。
AI解读:Anthropic发了新模型Claude Sonnet 5.5,价格和上一代Sonnet 5一样,但按照Simon Willison的说法,它在每一项基准测试上都胜过Sonnet 5,实际跑起来还更便宜:官方口径是速度快 30% 以上、大多数任务成本最多降低 30%。
这次最值得注意的是免费版用户的待遇变了。claude.ai的免费层现在用的是Sonnet 5.5,而OpenAI的ChatGPT免费层用的是Luna 5.6;按Willison的实测,用免费版让它生成一个WebGL三维骑自行车鹈鹕页面,结果“算得上扎实”,说明免费账户能拿到的能力被抬高了。
不过Sonnet 5.5也继承了Opus 5.5的一个已知毛病:把思考强度调到最高的“max”时,模型会先想满 128000 个token(花费 1.28 美元),然后token耗尽、没能产出SVG。同一任务改用“xhigh”档只花 5.74 美分、41 秒就出结果,所以这个最高档在实际使用里更像一个容易踩空的花钱选项。
对开发者和免费用户来说,这事的直接影响是:原本要付费才够用的代码类任务,现在免费层也能尝试;但若把思考预算拉到最顶端,成本可能不升反降地“交学费”。Anthropic还重申Haiku 5.5会在“未来几周”推出,具体定价尚未公布。
Anthropic今天发布新Sonnet模型Claude Sonnet 5.5。官方说法是它“运行速度快 30% 以上,大多数工作的成本最多降低 30%”。Simon Willison指出,Sonnet 5.5定价与Sonnet 5相同,但在所有基准测试上都胜过Sonnet 5,实际运行也应该更便宜。
Sonnet 5.5也出现了和Opus 5.5相同的一个缺陷:在“max”思考强度下,模型思考了 128000 个token(花费 1.28 美元)后token耗尽,没能生成SVG。Willison提供的“xhigh”思考强度版本则是花费 5.74 美分、耗时 41 秒生成。
Willison表示,Sonnet 5.5在一些编码任务上几乎和Opus 5.5一样好,包括多种传播较广的 3D动画技巧。
他认为Sonnet 5.5最有趣的一点是:它现在被用作claude.ai免费层的模型。OpenAI的ChatGPT免费层使用Luna 5.6,这意味着Anthropic目前提供的免费能力更强。Willison在免费层上运行了提示词“帮我构建一个HTML页面,用WebGL渲染一只骑着自行车的三维鹈鹕”,得到的结果“算得上扎实”。
Anthropic在公告中重申Haiku 5.5将在“未来几周”推出。Willison表示希望这款模型的定价能与GPT-6 Luna竞争。