GPT-6.1 Sol发布:智能指数逼近Astra,单任务成本不到其四分之一
Artificial Analysis数据显示,GPT-6.1 Sol在GPT-6 Sol发布仅 7 天后接替前者,智能指数仅比GPT-6 Astra低 1 分,每智能指数任务成本 0.72 美元,约为Astra的 22%。
AI解读:GPT-6 Sol上架刚满 7 天就被GPT-6.1 Sol替换。Artificial Analysis的评测显示,新版在智能指数上只比定位更高的GPT-6 Astra低 1 分,而每个智能指数任务的成本是 0.72 美元,不到Astra 3.26美元的四分之一。
更值得关心的是价格结构:GPT-6.1 Sol的输入/输出单价与GPT-6 Sol持平,都是每百万token 2美元和 10 美元,但缓存读取折扣从 90% 提高到 95%,所以agentic工作负载的混合价格略低。
代价是输出token多用了约 10% 到 30%。对于按token计费、且缓存命中率不高的场景,单价没降、输出变多,总账未必更便宜;反过来,智能指数提升让低、中推理档位在token效率上仍处于帕累托最优。
这份数据来自第三方评测机构Artificial Analysis的摘要,不是模型厂商的发布材料,具体任务、评测集和最大推理档位的设定会影响成本结论,实际使用前需要按自己的负载重算。
Artificial Analysis发布了对GPT-6.1 Sol的评测摘要:这款模型在GPT-6 Sol发布仅 7 天后将其替换,智能指数比GPT-6 Astra低 1 分,每智能指数任务成本为 0.72 美元,而GPT-6 Astra为 3.26 美元。
智能指数与评测分数
据Artificial Analysis,GPT-6.1 Sol相比GPT-6 Sol在智能指数上提升 4 分,相比GPT-5.6 Sol提升 5 分,最终落在GPT-6 Astra之下 1 分的位置。
在agentic知识工作方面,它在AA-Briefcase v1.1和GDPval-AA v2.1上分别提升 4 分和 5 分。其他提升包括:Terminal-Bench 4.0提升 12 分,Humanity's Last Exam提升 5 分,GDP.pdf提升 6 分,AA-Omniscience准确率提升 8 分,同时幻觉率从 60% 降至 54%。
在Artificial Analysis的Coding Agent Index中,GPT-6.1 Sol在最大推理档位下比GPT-6 Sol高 3 分,比GPT-6 Astra低 2 分。
价格与成本效率
GPT-6.1 Sol的定价与GPT-6 Sol一致:输入每百万token 2美元,输出每百万token 10美元,唯一变化是缓存读取折扣从 90% 提高到 95%。Artificial Analysis因此认为,其面向agentic工作负载的整体混合价格略低于GPT-6 Sol。
这次降价是在GPT-6 Sol已对GPT-5.6 Sol打过 50% 折扣的基础上进一步下调。
按每智能指数任务成本计算,GPT-6.1 Sol在最大推理档位下为 0.72 美元,比GPT-6 Sol的 1.05 美元低 31%,比GPT-5.6 Sol的 1.99 美元低 64%,仅为GPT-6 Astra 3.26美元的四分之一以下。Artificial Analysis表示,GPT-6.1 Sol的所有推理档位都推进了成本效率的帕累托前沿,即在同等智能水平下没有更便宜的模型。
Token用量与限制
Artificial Analysis提到,GPT-6.1 Sol在各推理档位上使用的输出token比GPT-6 Sol多约 10% 到 30%。不过由于智能指数上升,其低推理档位和中推理档位在token效率上仍处于帕累托最优。
以上数据来自Artificial Analysis的评测摘要,涉及具体评测集、推理档位和成本口径;不同任务和缓存命中率下结果会变化,使用前需按实际负载核算。