OpenAI很快推新AI模型Astra 但因性能太强将限制网络安全能力
来源:凤凰网 9 小时前

OpenAI

凤凰网科技讯 北京时间9月2日,据彭博社报道,OpenAI计划很快推出一款名为Astra的强大新AI模型,但表示将限制能够使用该软件最先进网络安全功能的用户范围。

OpenAI周二在一篇博文中表示,将“很快”发布该AI模型,但没有透露具体时间。该公司称,最初只有一小部分测试人员能够使用该模型执行高级网络安全相关任务。之后,公司将通过其Daybreak Blue计划向更多用户开放防御性网络安全用途的访问权限,该计划允许获批的测试人员使用其最强大的模型,并配备适用于网络安全工作的安全保障措施。

该公司曾在8月表示,由于发现Astra模型在网络安全任务方面具备很强的能力,因此暂停了部分内部开发工作,以便加入更严格的安全防护措施。

OpenAI周二表示,公司认为该模型已经达到所谓的“关键网络安全门槛”,这意味着该模型能够在无需人类干预的情况下识别并开发零日漏洞利用程序。该公司称,已加强Astra模型的安全防护措施,以防止其被滥用,尤其是在网络安全相关操作方面。

这些安全防护措施包括:在内部部署期间监控模型是否存在未经授权的行为,并自动终止可能存在未经授权的活动。

OpenAI在8月底发布报告称,公司本可以更早做出反应,以防止其AI模型在7月对Hugging Face 发动意外黑客攻击。这起“前所未有”的事件,加上近期发生的其他几起网络安全入侵事件,引发了人们对AI智能体失控的担忧。这也促使一些科技界和政府领导人再次呼吁对该技术进行限制。

OpenAI周二表示,尽管Astra并非参与Hugging Face入侵事件的模型之一,但公司利用从该事件中汲取的经验,为Astra模型增加了更强的安全护栏,以训练其拒绝回答“有害的网络请求”。(作者/箫雨)

简体中文 English