谷歌发布Gemini 4 Argon,初期仅限“可信网络防御者”使用
谷歌首席AI架构师Koray Kavukcuoglu称,该模型在软件工程、法律金融等企业知识工作和网络安全防御等复杂工作流中达到前沿性能,但目前仅向一组“可信网络防御者”开放,并称正参与美国政府预发布模型访问的自愿流程。
AI解读:谷歌发布新一代前沿模型Gemini 4 Argon,官方给出的适用场景集中在三类:真实软件工程、法律和金融等企业知识工作、以及网络安全防御。模型能力定位很高,但访问门槛同样高,目前只对一组“可信网络防御者”开放。
这次限制不是常规的付费或区域灰度,而是按“防御者”身份发放,同时谷歌表示正参与美国政府关于模型预发布访问的自愿流程,并会逐步扩大开放。对想立刻试用该模型的开发者或企业来说,短期内没有通用入口;对承接网络安全防御任务的机构,这条新闻更直接相关。
谷歌称Gemini 4 Argon已在其内部工作流中运行,例如辅助大规模代码库迁移,并公布对比OpenAI和Anthropic竞品的多项基准测试图表。这些说法来自谷歌一方,基准选择和效果仍有待第三方验证。
发布时点紧接OpenAI DevDay,后者推出Dots AI代理与GPT-6.1 Sol,并称出于安全担忧不发布原计划的GPT-6.1 Astra。在扩大开放前,谷歌表示将加强防御滥用、提示注入攻击以及对目标偏离的监控等关键前沿保障措施。
谷歌发布其下一代AI前沿模型,命名为Gemini 4 Argon。谷歌首席AI架构师、Google DeepMind高级副总裁Koray Kavukcuoglu表示,该模型在真实软件工程、法律和金融等企业知识工作、以及网络安全防御等复杂工作流中具备“前沿性能”。
谷歌初期将访问权限限制在一组“可信网络防御者”之内。Kavukcuoglu称,谷歌“正积极参与美国政府关于预发布模型访问的自愿流程,同时逐步扩大访问”。
Kavukcuoglu表示,Gemini 4 Argon已在驱动谷歌的“内部工作流”,并举例称该模型帮助完成了大规模代码库迁移等任务。
谷歌还公布了一张大型图表,展示Gemini 4在多项基准测试中优于OpenAI和Anthropic竞品模型。The Verge提到,AI社区本周早些时候曾在X上热议疑似泄露的新模型基准数据。
谷歌表示,在更广泛铺开之前将加强“关键前沿保障措施”,包括防御滥用和提示注入攻击,并监控目标偏离(misalignment)。
Gemini 4 Argon发布前一天,OpenAI刚举行DevDay大会,推出Dots AI代理和GPT-6.1 Sol模型;OpenAI本周还表示,出于安全担忧,不会发布原计划的GPT-6.1 Astra模型。此次发布也发生在Kavukcuoglu于 8 月被任命为DeepMind新负责人后不久。