AI Agent 技能库的悖论:何时失效?

2026-08-23·6 min read·OKCodex 编辑部

技能库的诱惑与陷阱

近期,普林斯顿大学与加州大学圣迭戈分校联合发表的一项研究,给 AI Agent 开发者们泼了一盆冷水:所谓的“技能”(skills)确实能让 Agent 表现得更好,但并非因为赋予了它更多知识,而是因为提供了结构化的流程。更关键的是,当技能库不断膨胀时,Agent 反而越来越难以找到正确的指令组合。

这项研究直指当前 Agent 工程实践中的一个核心痛点——我们热衷于构建庞大的技能库,却忽略了检索和编排的复杂性。

研究核心:结构化流程 > 知识注入

研究者通过实验发现,当给 Agent 添加“技能”时,其性能提升主要来自工作流的明确化——即告诉 Agent 先做什么、后做什么、如何分支处理。这相当于把隐性的经验显性化为可执行的步骤。然而,一旦技能数量超过某个阈值,Agent 在检索时就会“迷失”,要么选错技能,要么在多个技能间反复横跳,导致任务失败率上升。

这其实与人类认知中的“信息过载”现象异曲同工。当你的工具箱里只有一把锤子时,你看到什么都是钉子;当你有上百种工具时,你反而会花大量时间挑选工具,而忘了敲钉子本身。

与 OpenRouter 数据的呼应

有趣的是,这一结论与另一份数据遥相呼应。OpenRouter 平台显示,AI Agent 的 token 消耗量自 2025 年 2 月以来增长了 14 倍,而人类使用量仅增长 2.8 倍。其中近 70% 的 Agent token 消耗来自廉价的缓存提示词(cached prompts)。这意味着,Agent 的“思考”越来越多地依赖于重复调用固定的指令模板,而非实时推理。

这恰恰印证了技能库的“结构化流程”价值——缓存提示词本质上就是技能库的一种实现形式。但同时也暗示,如果技能库设计不当,Agent 可能会陷入机械化的套路,而非真正的智能决策。

对中国开发者的启示

对于正在构建 Agent 应用的中国团队,这项研究提供了三个直接可落地的建议:

  1. 克制技能数量:不要追求大而全的技能库。根据业务场景,精选 5-10 个核心技能,并定期清理低频技能。研究表明,技能库超过 20 个后,检索准确率会显著下降。

  2. 设计检索机制:与其依赖向量相似度检索,不如为技能设计显式的元数据标签(如适用场景、输入输出格式),甚至可以引入一个“路由 Agent”来专门负责技能选择。

  3. 优先结构化流程:在编写技能时,重点描述执行步骤和决策分支,而不是塞入大量背景知识。知识可以通过外部知识库动态调用,而流程必须固化在技能中。

结论

技能库不是越大越好,结构化流程才是 Agent 性能提升的关键。在 Agent 落地过程中,我们应当像软件工程师管理代码库一样,对技能进行版本控制、代码审查和定期重构。记住:一个 10 技能的 Agent 可能比一个 100 技能的 Agent 更可靠、更高效。

下次当你准备给 Agent 添加新技能时,先问自己:这个技能是否引入了新的流程,还是只是重复了已有知识?如果是后者,也许你需要的是更好的知识检索,而非又一个技能。

分享:微博

订阅每周好码简报

评论

加载中…

发表评论

0 / 500

评论经过审核后显示。

换两个模型分析这个主题

已预选 DeepSeek 与 Qwen,并带入文章主题;确认后才会运行。

试一下 →

Related

延伸 · 精选 Agent

AI Agent 技能库的悖论:何时失效? · OKCodex Blog · 好码未来 OKCodex