模型Artificial Analysis·原文 2026年9月29日本站收录 2026年9月30日

GPT-6.1 Sol发布:智能指数逼近Astra,单任务成本不到其四分之一

Artificial Analysis数据显示,GPT-6.1 Sol在GPT-6 Sol发布仅 7 天后接替前者,智能指数仅比GPT-6 Astra低 1 分,每智能指数任务成本 0.72 美元,约为Astra的 22%。

AI解读:GPT-6 Sol上架刚满 7 天就被GPT-6.1 Sol替换。Artificial Analysis的评测显示,新版在智能指数上只比定位更高的GPT-6 Astra低 1 分,而每个智能指数任务的成本是 0.72 美元,不到Astra 3.26美元的四分之一。

更值得关心的是价格结构:GPT-6.1 Sol的输入/输出单价与GPT-6 Sol持平,都是每百万token 2美元和 10 美元,但缓存读取折扣从 90% 提高到 95%,所以agentic工作负载的混合价格略低。

代价是输出token多用了约 10% 到 30%。对于按token计费、且缓存命中率不高的场景,单价没降、输出变多,总账未必更便宜;反过来,智能指数提升让低、中推理档位在token效率上仍处于帕累托最优。

这份数据来自第三方评测机构Artificial Analysis的摘要,不是模型厂商的发布材料,具体任务、评测集和最大推理档位的设定会影响成本结论,实际使用前需要按自己的负载重算。

Artificial Analysis发布了对GPT-6.1 Sol的评测摘要:这款模型在GPT-6 Sol发布仅 7 天后将其替换,智能指数比GPT-6 Astra低 1 分,每智能指数任务成本为 0.72 美元,而GPT-6 Astra为 3.26 美元。

智能指数与评测分数

据Artificial Analysis,GPT-6.1 Sol相比GPT-6 Sol在智能指数上提升 4 分,相比GPT-5.6 Sol提升 5 分,最终落在GPT-6 Astra之下 1 分的位置。

在agentic知识工作方面,它在AA-Briefcase v1.1和GDPval-AA v2.1上分别提升 4 分和 5 分。其他提升包括:Terminal-Bench 4.0提升 12 分,Humanity's Last Exam提升 5 分,GDP.pdf提升 6 分,AA-Omniscience准确率提升 8 分,同时幻觉率从 60% 降至 54%。

在Artificial Analysis的Coding Agent Index中,GPT-6.1 Sol在最大推理档位下比GPT-6 Sol高 3 分,比GPT-6 Astra低 2 分。

价格与成本效率

GPT-6.1 Sol的定价与GPT-6 Sol一致:输入每百万token 2美元,输出每百万token 10美元,唯一变化是缓存读取折扣从 90% 提高到 95%。Artificial Analysis因此认为,其面向agentic工作负载的整体混合价格略低于GPT-6 Sol。

这次降价是在GPT-6 Sol已对GPT-5.6 Sol打过 50% 折扣的基础上进一步下调。

按每智能指数任务成本计算,GPT-6.1 Sol在最大推理档位下为 0.72 美元,比GPT-6 Sol的 1.05 美元低 31%,比GPT-5.6 Sol的 1.99 美元低 64%,仅为GPT-6 Astra 3.26美元的四分之一以下。Artificial Analysis表示,GPT-6.1 Sol的所有推理档位都推进了成本效率的帕累托前沿,即在同等智能水平下没有更便宜的模型。

Token用量与限制

Artificial Analysis提到,GPT-6.1 Sol在各推理档位上使用的输出token比GPT-6 Sol多约 10% 到 30%。不过由于智能指数上升,其低推理档位和中推理档位在token效率上仍处于帕累托最优。

以上数据来自Artificial Analysis的评测摘要,涉及具体评测集、推理档位和成本口径;不同任务和缓存命中率下结果会变化,使用前需按实际负载核算。

信息来源