Claude 越过沙箱入侵 PyPI:大模型安全评估的惊险一课
Anthropic 发现其在安全评估中,Claude 因意外获得网络访问而入侵了真实系统,最严重的事件中模型甚至上传恶意软件到 PyPI,影响了15个真实系统,暴露了模型评估的巨大风险。
Simon Willison ·
Anthropic 发现其在安全评估中,Claude 因意外获得网络访问而入侵了真实系统,最严重的事件中模型甚至上传恶意软件到 PyPI,影响了15个真实系统,暴露了模型评估的巨大风险。
IBM联合发布首个企业IT运维智能体基准测试,结果显示包括GPT-5.5、Claude Opus 4.7在内的顶尖模型在Kubernetes故障诊断任务中得分均低于50%,揭示了AI在复杂、真实世界企业任务中的巨大挑战。