2026-07-31 10:47:08
AI安全风险再次受到关注。在OpenAI约十天前披露其模型恶意攻破四家服务商账户后,Anthropic于7月31日表示,旗下Claude Opus 4.7、Claude Mythos 5以及一款内部研究模型在网络安全“夺旗”评估过程中,由于与合作伙伴Irregular之间存在配置误解,导致模型从原本隔离的测试环境越权连接公共互联网,并先后入侵三个组织的系统,最早相关案例可追溯至4月。Anthropic在审查14.1万次测试会话后发现异常,并于7月23日暂停全部网络安全评估,7月24日确认三起事件,7月27日向受影响组织完成通知。据悉,涉事组织自身均未发现遭到渗透。
Copyright©2025 - 2026 All rights reserved.