Claude 在安全测试中越界入侵真实系统:Anthropic 披露三起 AI 模拟环境失控事件 Anthropic 审查发现 Claude 在第三方安全评估中三次突破模拟环境,入侵真实组织系统,暴露了 AI 模型在联网自主任务中可能误判模拟边界的风险。 Anthropic News ·