A dark server room with a glowing green server
人工智能

谷歌优先向网络安全合作伙伴推出Gemini 4 Argon

前沿模型受到美国政府预发布评估的限制,目前尚无公开发布日期或指定合作伙伴。

作者:Elliot Marsh阅读 4 分钟

Alphabet推出了Gemini 4 Argon,并开始了分阶段的推出,首批合作伙伴为特定的网络安全合作伙伴,而不是广泛的开发者发布。谷歌还在进行美国政府的预发布安全评估,将激进的基准声明与故意限制的访问路径相结合。

谷歌已开始推出Gemini 4 Argon,称其为迄今为止最先进的AI模型,具有“在编码、网络安全和复杂专业工作方面的重大改进。”首次访问是有限的:Argon将作为分阶段发布的开幕阶段,提供给一组“受信任的网络安全合作伙伴”。

这种分阶段的推出很重要,因为它是一种分发选择,而不仅仅是一个营销口号。谷歌没有透露初始合作伙伴的名称,也没有说明什么样的组织被视为“受信任”,并且没有公布公共发布日期或后续阶段的详细时间表。

该公司还将Argon定位为在其自身运营中已经有用。谷歌表示,该模型正在内部用于优化其数据中心的内存,释放出“数百TB的内存”,而无需购买额外的硬件。它还表示,量子计算研究人员已经利用了该模型。

基准定位:谷歌表示Argon在网络安全方面超越或匹配GPT-6 Astra、Grok 4.7和Anthropic。

谷歌对Argon的性能宣传广泛且具有竞争力。该公司表示,Argon“在现实世界的软件工程中创下新纪录”,“在网络安全方面并列第一”,并且“在另一个基准中领先”,该基准衡量金融、法律和其他专业任务的性能。

在面对面的比较中,谷歌表示Argon在网络安全基准上与OpenAI的GPT-6 Astra和Grok 4.7并列。它还表示,Argon在Vals Index上领先于GPT-6 Astra和最近的Anthropic模型,Vals Index是谷歌提到的一个基准指数,用于衡量专业任务的性能,但在提供的细节中没有定义其方法论。

对交易者来说,问题在于没有明确的内容。谷歌没有具体说明“现实世界的软件工程”记录声明背后的基准名称或评分细节,也没有识别用于跨专业比较的“另一个基准”。没有这些基本信息,这些声明很难映射到可重复的框架或第三方复制。

谷歌还将Argon框定为相较于其在九月早些时候发布的Gemini 3.8 Flash Cyber模型的一个重要网络安全升级,包括在漏洞发现方面的表现优于前者。这对于以网络为重点的模型线来说是一个快速的迭代节奏,并且设定了“前沿”发布可能越来越多地基于安全能力而非一般聊天性能的预期。

公众访问前的安全把关:美国政府评估和提示注入保护措施。

谷歌将Argon的公开可用性与安全流程联系在一起,而不仅仅是模型的准备情况。该公司表示,它将在更广泛的发布之前与美国政府合作进行发布前的安全评估,并将发布计划描述为分阶段进行,特别是为了在将一个强大的防御模型交到防御者手中时建立信心。

谷歌的Gemini模型产品负责人Tulsee Doshi表示:“以这种方式开始推出让我们更有信心,但也使我们能够尽快将经过训练且在网络防御方面强大的模型交到防御者手中。”

谷歌还表示,它希望在公开发布之前在四个关键网络安全领域扩大安全保障,并明确提到了误用和提示注入。提示注入是一种攻击者构造输入以操纵AI系统忽略规则或泄露敏感信息的技术,而这是模型嵌入到可以接触代码、凭证或工作流程的工具中后最重要的失败模式之一。

两个近期里程碑将使推出路径更容易定价:谷歌命名初始网络安全合作伙伴或扩大访问范围超出第一批,谷歌发布公开发布日期或在美国政府发布前评估后提供更清晰的分阶段时间表。第三个是披露:关于“记录”和跨专业声明背后未指定基准的更多细节,以及任何第三方的证实。

我的看法:为什么网络优先发布对加密交易者比基准更重要

决定这是否是真正市场输入的部分不是Vals Index的项目,而是分发门槛。网络合作伙伴优先推出意味着谷歌将Argon视为需要控制曝光和现实世界对抗测试的能力,而未命名合作伙伴的细节则表明这更接近于封闭试点而非引人注目的平台时刻。

重要的门槛是美国政府的发布前安全评估是否转化为具体的时间表和可交付的控制措施,特别是在误用和提示注入方面。如果谷歌开始命名合作伙伴,发布基准测试细节,并从“阶段”转向日期,Argon就不再是关于前沿性能的叙述,而是一个可以实际改变安全支出和AI基础设施定位的操作催化剂。

来源