别再给AI技能写“小说明书”了!龙虾之父教你用极简风格给Agent省Token

导语:你的Agent是不是越用越贵、反应越慢?别把技能描述写成小说了,看看“龙虾之父”的瘦身奇招。

写Agent写着写着,很多开发者就犯了“写书式描述”的毛病。每一个Skill的描述恨不得塞进祖宗八代的业务逻辑,把所有的参数说明、背景和边界条件全码进Prompt里。结果显而易见:Agent不仅反应慢得像树懒,账单上的Token消耗更是蹭蹭往上涨,甚至大模型自己都会在冗长的字海中迷失方向,导致频频选错工具。

前PSDFKit创始人、被技术圈亲切称为“龙虾之父”的Peter Steinberger最近在社交平台发文,吐槽现在的Skill提示词写得太乱,严重影响了Agent的运行效率。许多人把Skill描述写得像本书一样,乱七八糟的信息都往上下文里塞。为了解决这个普遍痛点,他写了一个用于给Skill做整体审计和瘦身的开源工具——skill-cleaner,瞬间在AI圈子里引发了大范围共鸣。

评论区里有一位开发者分享了自己的真实痛点:他之前写了个90多个词的描述,大模型愣是不知道该怎么正确调用技能;后来他暴躁地把描述删减到40词以内,动作直接,语义精炼,结果AI反倒能次次精准命中。这就好比你在路口立个指示牌,上面密密麻麻印了一整章使用守则,司机累得根本看不过来,远不如“由此去”三个字来得管用。

“路标”还是“说明书”?Skill的架构分工要理清

很多开发者在设计Agent时,混淆了Prompt和底层代码的分工。Peter对此提出了一个直击痛点的论点:Skill提示词是路标,而不是具体的说明书。其目的只是让Agent在成百上千的接口中快速识别出正确的方向。至于精细的规则和逻辑,那是执行代码(例如系统内的脚本和后端逻辑)的工作,压根不需要暴露到大模型的思维上下文中。

Peter开源的 skill-cleaner 恰恰就是这个理念的绝佳模板。在这个清理工具里,起主导指挥作用的 Skill.md 文件仅仅使用了56行极简提示词进行编写:

【Agent提示词瘦身】Agent开发Token优化指南

而在这个精炼路标的背后,则是由足足近千行的Node.js脚本代码来处理核心的清理与重构逻辑:

【Agent提示词瘦身】Agent开发Token优化指南

这正是典型的“前轻后重”架构。让大模型只接收几十行的路牌指引,真正消耗计算资源的脏活累活全被底层JS代码包揽,巧妙避开了用大模型推理去计算大量冗余文字的低效行为。

五项体检指标,揪出吃Token的“幕后元凶”

要把技能提示词清理干净,绝非凭感觉瞎猜。这个诊断工具有五套极其严谨的审计功能,能全面分析开发者在构建智能体时积攒下的代码历史包袱:

  • 技能提示词预算审计: 自动评估每个技能占用的上下文Token空间。通过预算比例分析,向开发者直观指出哪些技能正在超出安全配额,吃掉了过多的宝贵Token。
  • 同名重复技能查杀: 跨Codex内置库、插件缓存、代码库和个人技能根目录进行拉网式扫描。判定是否存在相同名字或描述文本极度雷同的技能红线,标记出多余副本。
  • 闲置技能检测: 结合历史日志和运行轨迹,梳理出从未被调用或提及的冷门技能,防止其常驻上下文。
  • 加载链路汇总: 遍历并标记每个技能的来源根目录及当前的启用/禁用状态,理清技能的层级依赖。
  • 冗长描述精简推荐: 专门针对那些废话连篇的技能描述,利用一套语法压缩引擎提供简捷语法的替换方案。

在你的项目根目录跑一圈脚本之后,系统会吐出一份简洁的技术体检报告:

【Agent提示词瘦身】Agent开发Token优化指南

底层逻辑:硬核算账与动作词替换

在底层算法实现上,这个清理脚本引入了Codex官方的逻辑设计。例如,它会自动加载本地配置好的大模型缓存参数上限(默认为虚拟的272k Token限额),并强制使用UTF-8字节除以4并向上取整的模型计费规则来测算每一句Prompt。此外,结合“系统技能 > 内置技能 > 插件技能 > 仓库自定义技能”的层级权重,如果在模拟运行中发现预算超载,不仅会给出警告,还会直接列出可能被阶段过滤掉的长尾技能,帮助开发者在上线部署前拿到精准的资源预测。

在核心工作流上,这套工具的设计也秉持着即插即用的原则。开发者只需要在项目的技能目录或者仓库根目录运行这个Node.js脚本,就能根据预设的时间范围、日志深度以及预算限制进行深度定制化扫描。脚本运行完毕后,会自动渲染出一条条极具可读性的报告,顺着预算消耗、优化建议、重复项、僵尸技能再到最终目录的顺序顺藤摸瓜。

最妙的还是它对描述文本的瘦身机制。整个过程更像是精细的手术,脚本首先会对导入的技能说明文案进行格式清洗,去除所有的标点符号、无意义换行,并将字符全部小写,移除起修饰作用的冗长前缀词。然后,它会利用内置的一套轻量化行业关键词库,自动判断这行技能到底属于哪个业务场景(例如测试、发版或是归档)。一旦锁定了具体的场景类型,脚本就会调用预设好的动作词组去覆盖原本累赘的长句。例如:原本需要用数十个字符交代的排错流程会直接被简写为 debug, inspect, fix 等核心动词;部署流程统一被替换为 deploy, release, verify ;文献或数据检索类则会被改写为 search, sync, summarize

【Agent提示词瘦身】Agent开发Token优化指南

把“省Token”刻进开发基因里

对于追求灵敏度的Agent架构来说,极致的轻量化代表着更高响应度与更低的账单成本。这个轻量化脚本的思维模式非常适合目前的工程实践。有趣的是,Peter本人在业界的交流中,甚至也开始调侃式地使用这种剥除多余修饰的“穴居人”表达:

“install skill / agent smart / user happy”——极简的叙事风格反而透露出极强的工程智慧。当我们在致力于让智能体去做更复杂的规划和跨平台协作时,先扫除自己写在Prompt里那些裹脚布一样的多余语言,让核心重点直接暴露在大模型的最佳视野里,这才是做AI工程应用最踏实的路子。

© 版权声明

相关文章