(三藩市29日讯)OpenAI当地时间周一证实,由于内部测试显示其最新人工智能(AI)模型Astra 6.1不符合安全标准,该公司将不会发布该模型。 OpenAI是ChatGPT的开发商。
法新社报导,这家人工智能巨头将于当地时间周二在三藩市举办一年一度的开发者大会OpenAI DevDay,预计该公司将在大会上发布多项公告,但目前尚不清楚新版Astra是否包含在内。
OpenAI安全系统负责人贾恩在声明中表示,Astra 6.1在某些方面比之前的模型有所改进,但“在控制范围、授权以及如何向用户反馈其工作类型方面,它并未完全达到标准”。
贾恩说:“我们希望确保模型开发过程安全可靠,无论是在公司内部还是交付给用户时。但当交付给用户时,我们在安全性和一致性方面有著极高的标准。”
近几个月来,OpenAI和竞争对手Anthropic开发的模型在测试期间发生安全事件,引发了人们对人工智能安全性的担忧。
使用OpenAI模式建构的智能体曾不当造访美国联邦机构、澳洲政府健康统计入口网站以及人工智能模型库Hugging Face的网站。
OpenAI、Anthropic和其他主要人工智能开发人员承诺,将优先开发具有安全防护措施以降低风险且符合人类价值观的模型。
美国晶片巨擘英伟达(Nvidia)周一宣布,已开发出一套系统,旨在防止自主人工智能程式偏离其预设指令。
英伟达首席执行员黄仁勋周一在接受CNBC采访时说:“我认为这是一个工程问题……我们都应该希望这是一个工程问题,如果不是工程问题,那就无解了。”
英国政府下属的人工智能安全研究所(AISI)周一发布的一项研究表明,GPT-6 Astra在测试中比其前代产品GPT-5.6 Sol和GPT-5.5更容易出现异常行为。
在模拟测试中,GPT-6自发性发动网络攻击的频率显著高于其他两个版本。