OpenAI正暂停其即将推出的一款人工智能模型的相关内部工作,以实施更严格的安全保障措施 ,此前发现该系统在网络安全任务方面表现显著更胜一筹。

这家ChatGPT开发商周五表示,无法排除尚未发布的Astra模型将达到OpenAI的“关键网络安全阈值”的可能性,这意味着该模型无需人工干预即可识别并开发零日漏洞利用程序 。
在过去两周内 ,OpenAI和Anthropic PBC已公开承认,他们在测试模型时无意中入侵了包括Hugging Face Inc.在内的多家机构的系统。
这些最新披露的事件再次证明,AI智能体能够以连受过专业训练 、致力于发现该技术漏洞的研究人员都无法预料的方式自主行动,这凸显了实施更严格的安全筛查和建立更万无一失的测试环境的必要性。