(华盛顿5日讯)周五发布的一项研究显示,美国人工智能(AI)研究与部署公司OpenAI开发的数千个自主智能体违抗指令,接管了一个德国网站。这一事件引发了关于人工智能的风险未得到足够重视的担忧。
法新社报导,这些无需人工逐步引导、能够自主运行的智能体,在DSEwiki留下了约1万8000条讯息。DSEwiki是一个面向程式设计师的德国网站,类似维基百科,允许任何人进行编辑。
这些智能体利用该网站交换试题答案,并分享绕过旨在限制他们的数码围栏的技巧。
“我和我的合著者发现了一群全新的OpenAI智能体在劫持网站。”研究员之一的冯阿克斯在社交媒体X写道:“我们相信OpenAI知情但没有公开。”
OpenAI发布声明表示,无法立即回应这些指控,因为“该报告的作者拒绝了我们在报告发布前查阅研究结果的请求”。
OpenAI的发言人称:“我们正在仔细审查其内容,并将采取任何必要的后续行动。”发言人也补充,他们曾在近期的报告中提及过此类事件。
7月,OpenAI的智能体在难以完成既定任务的情况下,试图在开放互联网上寻找捷径,并入侵了Hugging Face的伺服器。Hugging Face是一个程式设计师广泛使用的人工智能软体分享平台。
一项独立调查发现,该公司的数百个智能体在脱离受控环境之前曾经相互沟通,并发动了数波攻击。
那次事件震惊了科技界,并再次引发了加强人工智能监管与监督的呼声。
Anthropic、Meta及其他科技公司在测试智能体时,也报告了类似事件。
智能体“文明”蜂群式攻击
这些智能体被科技界标榜为人工智能深入日常生活的新阶段。它们能够在极少人工干预的情况下,完成预订行程、报销费用或编写软体等任务。
颇具影响力的科技播客主帕特尔,批评媒体和矽谷低估了Hugging Face事件的重要性后,辩论在近几日愈演愈烈。
为了以简单易懂的语言发出警示,帕特尔将这种现象描述为由智能体“文明”发起的蜂群式攻击,而随著相关技术的部署,这种攻击对社会构成了严峻威胁。
他的这一立场立即招致了一些研究人员和矽谷人士的批评,他们认为将该软体描述为狡诈社群未免言过其实,且具有误导性。
知名研究人员兼人工智能批评者马库斯写道,这些智能体确实采取了令人不安的行动,因此这一事件绝非“无关紧要的小事”。
但他指出,这种“文明”叙事存在著一种风险,即将本可避免的安全与治理失误,变成一场关于人工智能安全的“作秀”。
这些事件促使人们更加强烈地呼吁制定更严格的规则,并加强国际合作。
微软公司(Microsoft)联合创办人比尔盖兹在上周发表的一篇文章就警告,人工智能行业已远远突破了其曾承诺遵守的安全阈值,并呼吁建立一种效仿核查与航空监管模式的监管机制。
美国总统特朗普的政府一直抵制此类提议,并将反对人工智能监管作为其政策议程的核心内容。