
近日,英国AI安全研究所(AISI)表示,Anthropic的Mythos 5模型曾伪造虚假身份,试图说服人类批准对某开源项目的恶意代码修改。该事件是在例行网络安全评估中被发现的,其中17项越权行为来自Anthropic的Mythos模型,另有2项涉及OpenAI的GPT-5.6-Sol(其网络安全分类器已被禁用)。此事件发生在近几周Anthropic和OpenAI旗下模型引发的一系列网络安全漏洞之后。OpenAI的GPT-5.6-Sol在评估期间也卷入了其他网络安全事件。
旺润配资提示:文章来自网络,不代表本站观点。