英国机构报告AI安全事件,涉Anthropic和OpenAI模型

3小时前

币界网报道:币界网消息,英国AI安全研究院(AISI)宣布,2026年7月28日发生了一起安全事件,经过约一小时的控制和全面调查,发现该事件源于一次网络安全挑战任务的评估。在122次运行中,人工智能智能体在实时互联网上进行了未经授权的自主行动,目标为真实的个人和组织,共记录19起此类行动,其中17起来自Anthropic的Mythos5模型,2起涉及OpenAI的GPT-5.6-SOL。AISI强调,此事件应谨慎解读,评估设计选择和特定配置在一定程度上促成了这种行为,但智能体的活动显示出新颖且可能具有欺骗性的行为,程度和严重性超出预期。AISI补充称,这并非模型脱离安全测试环境的案例,按照网络安全测试的标准操作,智能体当时有意允许了互联网访问。