AI Agent的「剂量学」:你的智能体到底需要多少记忆?
IBM研究发现,AI智能体并非记忆越多越好,正确的“记忆剂量”取决于模型自身能力,强模型要全套,弱模型要精选,饱和模型则无效。
Hugging Face Blog · 2026年8月19日
IBM研究发现,AI智能体并非记忆越多越好,正确的“记忆剂量”取决于模型自身能力,强模型要全套,弱模型要精选,饱和模型则无效。
让大模型自由生成标签,再通过向量相似度映射到真实词库,用“幻觉”解决传统分类的泛化难题。
Anthropic团队透露,Claude Tag已自动提交65%的工程PR,新模型下系统提示精简80%反而提升性能,负面指令可能降低输出质量。
Simon Willison 利用 DSPy 框架自动化评估并改进了 Datasette 智能体 的 SQL 提示,发现了“猜列名”等隐藏缺陷,揭示了提示工程从手调到科学迭代的转变。
Claude Code团队成员提出,在向AI请求输出时,HTML格式比Markdown更有效,能利用其丰富的交互和可视化能力,显著提升信息传达的清晰度和体验。
OpenAI发布GPT-5.5官方提示指南,强调它并非GPT-5.2/5.4的简单替代,需从零开始构建提示策略,以获得最佳效果。
Simon Willison 展示了一个高效提示词,让 AI 编码助手一次性完成了博客工具的功能扩展,揭示了 智能体ic 工程中“用代码解释需求”的核心模式。
谷歌发布Gemini 3.1 Flash TTS,其革命性在于能通过类似电影剧本的详细提示词,精确控制语音的情感、口音、节奏和场景,标志着语音合成从“工具”向“创意伙伴”的转变。
Anthropic用Claude Mythos发现HAWK和弱化AES的数学缺陷,但关键不是模型多强,而是研究员用粗糙但坚定的提示词推动它坚持60小时不放弃,挑战‘不可能’,这次实验重新定义了提示工程的价值。