来源信息

  • 文档类型:阅读笔记 · 整理日期 2026-10-07
  • 原文:《Lessons from building Claude Code: How we use skills》 · 作者 Thariq Shihipar · 发布于 claude.dev · 发布日期 2026-06-03
  • 原文地址:https://claude.dev/blog/lessons-from-building-claude-code-how-we-use-skills/
  • 本文为阅读整理,观点与数据以原文为准;原文不提供的事实均已标注为整理者说明。

阅读范围

  • 已读取全文,覆盖定义、分类、制作、分发、市场、组合、衡量与起步。

定义与九类用途

Skill 是可发现的指令、脚本和资源目录,不只是一篇 Markdown。文章归纳九类:库与 API 参考、产品验证、数据分析、业务自动化、脚手架、质量审查、交付部署、故障手册、基础设施操作。分类是内部经验框架,职责过杂会增加选择困难;验证类被作者认为特别有价值。

制作机制

内容应补充模型缺少的项目知识,积累真实失败形成的 gotchas。主文件指向按需读取的参考、模板和脚本,避免一次塞满上下文。约束目标而非锁死所有步骤;缺少初始配置时先询问。描述字段用于触发判断,应写清何时使用。

日志可保留执行历史,辅助代码让模型组合已有能力;按需 hooks 可在当前会话增加特定防护。持久数据应与安装内容区分,避免更新时丢失状态。

分发、组合与衡量

少量仓库可直接共享技能,规模扩大后按需安装更合适。市场先让技能试用,再由实际采用推动纳入。技能可引用其他技能,但文章发表时没有原生依赖管理,前提是依赖已安装。调用日志可发现热门或触发不足的技能;起步宜从小规则和一个常见坑逐步改进。

这些是当时 Anthropic 的工作经验,不是当前平台功能的完整承诺。使用次数不等于有效性;应另外检查误触发、漏触发和结果质量,工具权限与外部副作用也要单独控制。

游戏开发应用建议

以下为整理者建议,非原文实测,也不表示已经实施。

可从“NPC 状态验证”这一窄技能开始,写清触发条件、输入、验收证据和不能自动执行的动作。将玩法参考与测试脚本分开,主文件只说明根据什么症状读取哪份资料。

  • gotchas 优先记录项目中实际出现的资源释放、任务打断、存档恢复问题;没有证据时标为待验证假设。
  • 验证脚本输出随机种子、状态变化和失败断言,便于复现;截图只补充可见体验,不能证明内部状态正确。
  • 配置记录目标场景与测试范围,运行记录区分成功、失败和跳过。先拿正常、边界和无关请求检查触发,再考虑共享。

这种设计把知识沉淀与执行权限分开:能复用经验,不代表获得发布、删除资源或改动线上数据的授权。先证明小技能有用,再扩展职责,比立即建立庞大技能库更容易维护。

小结

技能价值来自项目特有知识、可执行验证和持续修正;清楚触发、按需加载与可复查结果应一起设计。

参考来源

相关笔记