(三藩市1日讯)美国科技巨头之一谷歌(Google)当地时间周三表示,将暂时不对外开放其最强大的人工智能(AI)模型,仅向经过审查的网络安全专家小组发布Gemini 4 Argon,以避免被骇客滥用。
法新社报导,谷歌首席人工智能架构师卡武克库奥卢在宣布该模型的部落格文章中写道:“安全地发布如此先进的前沿能力需要分阶段进行。”
谷歌表示,将自愿向美国政府提供该模型的早期访问权限,并在广泛发布之前收集测试人员的反馈。
这种谨慎的推广方式与竞争对手Anthropic的做法类似,后者将其最先进的模型Claude Mythos Preview限制在少数受信任的组织内使用。
今年6月,华盛顿曾短暂强制Anthropic公司暂停公开发布Claude Mythos和Claude Fable模型的使用权限。此后,该公司建立了一套自愿审查流程,用于在发布前审核最强大的人工智能模型。
就在一天前,美国总统特朗普在白宫会见了包括谷歌首席执行员皮查伊和Anthropic联合创始人兼首席执行员阿莫代伊在内的多家科技巨头,他们签署了一项自愿协议,承诺监管各自人工智能系统的风险。
网络安全专家担心,这项尖端技术可能被用于攻击银行、医院和政府系统。
谷歌表示,Argon在软体工程、法律和金融工作以及网络防御等复杂任务方面表现出色,尤其擅长发现和修复关键软体缺陷。
谷歌称,早期测试人员利用Argon发现了全球多家医院使用的软体中的一个漏洞,该漏洞会泄露敏感的个人资讯,而其他一些先进模型却未能发现这一漏洞。
谷歌表示,Argon的设计初衷是拒绝可能用于实施网络攻击或研发化学、生物或核武的请求。
Anthropic和ChatGPT的开发者OpenAI也在其最先进的模型中,建构了类似的安全机制。
谷歌表示,他们正在监控该模型的推理过程,以防止其偏离用户预期,研究人员将这种风险称为“错位”。
自从OpenAI在7月披露其两个模型(其中一个尚未发布)在网络安全评估期间,突破密封测试环境并入侵人工智能公司 Hugging Face 的伺服器以来,这个问题变得更加紧迫。