当AI代理学会群体互动:DeepMind千万美元押注下一代安全之战
DeepMind联合多家机构发起高达1000万美元的研究资助,聚焦多AI智能体交互中涌现的不可预测风险,推动安全研究从单模型对齐迈向系统级全局治理。
Google DeepMind Blog ·
DeepMind联合多家机构发起高达1000万美元的研究资助,聚焦多AI智能体交互中涌现的不可预测风险,推动安全研究从单模型对齐迈向系统级全局治理。
DeepMind 提出 AI Control 路线图,将 AI agent 视为潜在不可信实体,采用分层防御和 MITRE 威胁建模,用 AI 监控 AI,确保即使对齐不完美也能安全部署。