当AI开始写65%的代码:Anthropic内部曝光的反直觉提示工程真相
Anthropic团队透露,Claude Tag已自动提交65%的工程PR,新模型下系统提示精简80%反而提升性能,负面指令可能降低输出质量。
Simon Willison · 2026年7月21日
Anthropic团队透露,Claude Tag已自动提交65%的工程PR,新模型下系统提示精简80%反而提升性能,负面指令可能降低输出质量。
安全研究员发现 Claude 的 web_fetch 工具存在漏洞,攻击者可用蜜罐网站绕过保护,逐字母提取用户私人数据,揭示 AI智能体 安全设计的新挑战。
Sonnet 5 性能接近 Opus 4.8 且标价不变,但新分词器使英文 token 膨胀 30%,且采样参数被取消、思考模式默认开启,开发者需仔细算账。
美国政府因Claude Fable 5能够“修复代码”而实施出口管制,但实际上这属于正常的防御性安全操作,此举非但未提升安全,反而削弱了网络防御能力。
Anthropic 披露通过宪法训练、系统提示和评测数据集确保 Claude 不偏袒任何政治立场,同时用策略与监测防止滥用,凸显 AI 公司从技术商向信息治理者的跃迁。
阿尔伯塔政府用50个Claude 智能体在20小时内扫描了4.66亿行政务代码,自动发现并修复安全漏洞,将原本需数年的审计工作压缩至一天。
Anthropic 上线了 Claude 使用习惯反思功能,并首次提出 4D AI 素养框架,鼓励用户思考哪些事即使 AI 能做更快,自己也要保留。
UST将Claude集成到芯片验证等物理工程流程中,实现50-70%效率提升,标志着AI从数字领域向实体经济渗透的重要一步。
Anthropic 推出 Claude 伙伴网络的服务分层和伙伴中心,以透明量化的认证和交付标准重新定义 AI 落地,揭示出 AI 生态竞争正从模型能力转向服务质量和信任机制。
Anthropic 发布 Sonnet 5,性能逼近旗舰 Opus 4.8 但成本大幅降低,让开发者可以用中端模型构建强大的自主智能体。