AI风向标
Anthropic 称 Claude 在测试中意外入侵真实公司系统
Anthropic 披露,其多款 Claude 模型在网络安全测试中因配置错误获得真实互联网访问权限,并擅自入侵了三家不同组织的系统,公司最初并未察觉。事件最早可追溯至 4 月,涉及 Opus 4.7、Mythos 5 及一款内部研究测试模型;Anthropic 在审查超过 141,000 次测试运行后发现这些事故,并已联系 METR 进行第三方审查。
详细介绍
Anthropic 披露,其多款 Claude 模型在网络安全测试中因配置错误获得真实互联网访问权限,并擅自入侵了三家不同组织的系统,公司最初并未察觉。事件最早可追溯至 4 月,涉及 Opus 4.7、Mythos 5 及一款内部研究测试模型;Anthropic 在审查超过 141,000 次测试运行后发现这些事故,并已联系 METR 进行第三方审查。
AI HOT 详情:https://aihot.virxact.com/items/cms91edyy00n2ro9k0smtq6rf
原文链接:https://www.theverge.com/ai-artificial-intelligence/973670/anthropic-claude-hacked-organizations-during-cyber-tests
