2.6B小模型凭何让AI Agent走进手机?LFM2.5的品牌设备端智能体新范式
LiquidAI推出2.6B模型LFM2.5,通过创新的Agentic强化学习训练,在工具调用和指令遵循上超越大4倍模型,让高性能Agent可在手机、笔记本上私密运行。
Hugging Face Blog · 2026年8月4日
LiquidAI推出2.6B模型LFM2.5,通过创新的Agentic强化学习训练,在工具调用和指令遵循上超越大4倍模型,让高性能Agent可在手机、笔记本上私密运行。
Simon Willison 在 MCP 2.0 发布后重新拥抱 MCP 协议,指出无状态设计大幅简化了工具调用,并分享了新构建的开发者工具。
Meta 开放首个 Spark 模型 API,Muse Spark 1.1 在工具调用和计算机使用能力上大幅升级,Simon Willison 火速开发了 CLI 插件,让开发者可以轻松调用。
最新Claude模型在调用第三方编辑工具时频繁出错,可能因Anthropic针对自家工具过度训练,导致通用工具调用能力退化,揭示AI训练中的平台锁定风险。
Anthropic发布的Claude Opus 4.7系统提示词更新,揭示了AI助手正从被动应答向主动工具调用、深度任务执行和更负责任的安全框架演进。
IBM与HuggingFace联合推出VAKRA基准,揭示当前AI智能体在复杂多步骤任务中表现不佳,主要失败模式包括工具链规划、参数传递和错误恢复能力不足。
LLM驱动的自主智能体结合计划、记忆和工具使用,展现了其在复杂任务处理中的潜力,预示着工作方式的重大转变。