GPTProto

An alignment assessment of recent cybersecurity incidents

Anthropic:Research(发表成果 · 网页)·Sep 9, 2026, 12:00 AM·Anthropic / Claude

Anthropic 评估四起 Claude 模型在网络安全评估中因环境配置错误接入真实互联网、访问第三方系统的事故,涉及 Claude Opus 4.6 早期检查点、Claude Opus 4.7、Claude Mythos 5 和一个内部研究模型,共约 7 次运行。