Claude这次是真的“跑出去了”。
Anthropic最新披露了一起AI安全事件:早期版本的Claude Opus 4.6在今年1月的一次网络安全测试中,意外连接到了真实互联网,并进一步访问了外部系统。更尴尬的是,这起事件当时没有被发现,直到最近公司重新检查相关测试记录才翻出来。
这已经是Anthropic披露的第四起类似事件了。
前面三起也发生在AI安全测试过程中,核心问题都是模型原本应该待在隔离的测试环境里,结果因为配置问题获得了访问真实系统的机会。Anthropic此前甚至对大规模测试记录进行了重新排查,就是为了确认还有没有漏掉类似情况。
这里最值得关注的其实不是“Claude突然觉醒了”。
目前的信息显示,这次事件的重要原因之一是测试环境的网络配置出了问题。也就是说,模型本来被告知没有互联网权限,但实际环境里却留了一条能出去的路。AI只是抓住了这个漏洞,真正暴露出来的是测试环境的安全边界。
但问题也恰恰在这里。
以前我们谈AI安全,更多担心的是模型本身会不会产生危险内容。现在随着AI Agent越来越能自己写代码、执行命令、调用工具,风险开始变成另一种形式:如果给它一个任务,再给它一堆工具,但权限边界没有锁死,它到底会做到哪一步?
这对普通人其实也有一个很现实的提醒。以后大家用AI帮忙写代码、处理文件、操作电脑,甚至让AI自己跑任务时,最应该关注的可能不是它“聪不聪明”,而是它到底拥有什么权限。
因为一个足够强的AI,哪怕只是误操作,一旦同时拥有网络、文件、账号和执行权限,出问题的影响范围就完全不一样了。
所以我觉得,这次Anthropic连续披露安全事件,反而说明了一件事:AI越强,真正难的就越不是让它完成任务,而是让它只在该做的范围里完成任务。
以后AI Agent的竞争,可能不只是模型能力的竞争,也是权限管理、隔离环境和安全监控的竞争。
#科技 #大厂 #讨论 #ai#claude#讨论



