|
|
|
如果你要问我,2026年最值得学习的AI技能是什么?我会毫不犹豫地推荐Skills。无论是Claude Code,还是龙虾、爱马仕,几乎所有的Agent,如果想把事情干得又快又好,都越来越依赖Skills。没有Skills的Agent,就像一位刚入职的新同事,你得培训,反复教他。而有了Skills的Agent,则更像是一位老同事,开箱即用,配合默契,非常靠谱。“同事.skill”可能只是个玩笑,但“work.skill”一定是刚需,是生产力。甚至在我看来,Skills很可能是今年Agent领域最重要的创新之一。简单理解:模型是大脑,Agent是躯体,而Skills就是双手。现在,只是学会怎么“问”AI,其实已经有点不够了。更重要的一件事是,学会怎么“教”AI。把你重复做的工作、团队里的隐性知识、那些“只有老员工才知道”的操作细节,封装成一个又一个的.skill文件。它们会成为你最好的数字同事。不摸鱼,不抱怨,随叫随到,而且越用越顺手。今天这篇文章,我会试着带大家从入门到精通,彻底搞懂Skills——理解skill,成为skill,超越skill。如果你是新手,相信一定会大有收获;如果你是老司机,也会看到一些新的启发。如果觉得有用,欢迎点赞、在看、分享三连。一起学习,一起成长。1、Skills是什么?——给AI发一本“员工手册”2025年10月16日,Anthropic首次发布Agent Skills。最初,Skills只能在Claude Code里使用,而且还必须是Claude的Pro付费用户。http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWhqARDVOAAFumOoBfQA779.png,1080,628Anthropic发布Agent Skills12月18日,Anthropic把Agent Skills作为统一标准,对外开放,不论你是不是Claude的付费用户,都可以使用。之后,很快像Codex、Cursor、Antigravity、OpenCode、Trae、Qoder、CodeBuddy等Coding Agent以及Claude Cowork、Skywork、MiniMax Agent、扣子等桌面Agent都陆续支持了Skills。也包括,2026年春节后爆火的OpenClaw(中文名“龙虾”)和最近大热的Hermes Agent(中文名“爱马仕”),也都支持Skills。http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWhuAVLl7AADSrIdUvjc181.png,886,504Skills,简单翻译过来就是“技能包”的意思。就像我们人一样,有很多的技能,比如骑车、游泳、开车、烹饪、摄影等。Skills,就是我们人类专门给AI准备的技能包。Anthropic官方定义:Skills是一套模块化能力,允许开发者通过结构化的文件夹来增强Claude Code的能力。每个Skill都包含一个核心的SKILL.md文件以及相关的辅助资源文件。当用户提出请求Claude Code时,它会根据请求内容和Skill的描述自动判断何时调用相应的Skill来处理这个请求。用一句话大白话来解释:Skills就是我们专门给AI定制的“标准操作手册(SOP)”。每个Skill都有一个专门的文件夹(核心文档 SKILL.md),用来放执行指令、资源文件和参考资料等。但千万别小看这个文件夹,它能让AI瞬间从“职场小白”变成“职场老司机”。为了方便大家理解,我们不妨拿“开一家汉堡店”来打个比方:http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWhuAZKFjAAGFjtBqMmA824.jpg,1080,589Prompt就像顾客的点单:“老板,给我做一个牛肉汉堡,不要洋葱!”(指令很明确,但怎么做全看厨师心情)。MCP就像厨房里的工具和食材:它给了AI铲子、平底锅、牛肉饼和面包(AI终于不用空手套白狼了)。Skills是这家店的秘制菜谱+员工守则:“第一步,肉饼必须煎 3分半钟;第二步,酱汁只能挤两圈半;做完后,必须清理灶台!”Skills规定了动作的先后顺序、质量底线和执行标准。有了它,AI就不再瞎猜你的心思,而是按部就班地干活。2、拆解Skills的核心架构简单理解Skills后,我们从文件夹层面来对Skills的架构做一个剖析。打开Claude Code的安装文件夹(默认是在C盘,文件名.Claude),找到Skills文件目录,通常你会看到这样的文件架构。http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWhyAA2eeAADEhoY10lE461.png,791,480「skill-creator」skill的文件夹架构SKILL. md:这是skill的核心指令,包括skill名称、触发条件、任务流程、执行指引等。scripts:用于存放可执行代码(如Python、Bash脚本等)。references:用于存放按需加载的参考文档,比如技术规范、API文档、代码片段、设计指南等,主要是给AI看的。assets:用于存放素材资源,比如模板、字体、图片、logo、背景资料等。通常,一份标准的Skill结构如下。skill-name/├── SKILL.md (必需)│ ├── YAML frontmatter (必需)│ │ ├── name: (必需)│ │ └── description: (必需)│ └── Markdown instructions (必需)└── Bundled Resources (可选) ├── scripts/ - 可执行代码 ├── references/ - 参考文档 └── assets/ - 资源文件这里面,除了SKILL.md是必选项以外,其他都是可选项,可根据自己的skill需要进行灵活配置。当Claude Code、OpenClaw这些Agent运行skill时,它会:以SKILL.md为第一指引,了解该skill对大模型的要求。结合当前的任务情况,判断是否需要调用scripts(代码脚本)、references(参考文档)和assets(素材资源)。最后通过“规划-执行-观察”的交错式反馈循环,来完成用户制定的任务要求。在整个架构中,SKILL.md最为关键,其内部架构如下:http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWhyAHBRpAAEH_89wuSg124.jpg,1080,579SKILL.md内部剖析(图by苍何)首先是skill的name,一般用英文和连字符“-”组成,比如一个前端设计skill,其name可以命名为「frontend-design」。然后是description(描述),这是skill的YAML元数据非常重要的一环。其质量决定了该skill能否被Claude Code准确触发。比如,Anthropic官方的frontend-design skill,它的description字段内容如下。「frontend-design.skill」的description字段翻译成中文,就是:“创建具有高级设计感的独特的、专业的、可用于实际生产的前端界面。当用户需要开发网页组件、页面或应用程序时,可运用此skill。生成的代码富有创意且精致,避免出现千篇一律的AI风格。”因此,写好SKILL.md中的description字段非常重要,因为它直接决定了Claude Code会在何种情况下自动触发并加载该skill。如果description写得不清晰或不准确,即使你的skill再强大,AI也可能在需要时“想不起来”使用它。根据最新的Agent Skills最佳实践和官方指南,以下是写好description 的核心策略和模板:1)核心原则:触发即正义Description的首要任务不是给人看的,而是给AI的路由机制看的。它需要明确回答两个问题:这个skill是做什么的?(功能定义)用户在什么场景/说什么话时应该使用它?(触发条件)2)“黄金结构”公式一个高质量的description通常遵循这个结构:[一句话核心功能] + [具体执行动作] + [明确的触发关键词/场景]。优秀写法示例:案例A:代码审查技能name: security-code-reviewdescription: Reviews code for security vulnerabilities and best practices. Use when the user asks to "review code", "check for bugs", "analyze security", or mentions specific issues like SQL injection, XSS, or performance bottlenecks.案例B:PDF 处理技能name: pdf-processordescription: Extracts text, tables, and metadata from PDF files; merges or splits documents. Use when working with PDF files, converting PDFs to text, filling forms, or when the user uploads a PDF and asks for summary/extraction.简单理解就是,写好description的秘诀在于模拟用户的提问方式。想象一下你会怎么向AI提出请求,然后就把这些请求中的关键词都塞进description里。通常,一个标准的SKILL.md,其Markdown格式大致是这样:---name: 你的skill名称description: 简要描述该技能的功能以及何时该使用它---# 你的技能名称## 指令 (Instructions)为 Claude Code 提供清晰、逐步的操作指南。## 目标 (Goal)## 示例 (Examples)展示使用该技能的具体代码或操作案例。比如,我们随手创建一个「PDF分析」skill,它的SKILL.md设计如下。---name: pdfdescription: 从PDF文档中提取和分析文本。当用户要求处理或阅读PDF时使用。---# PDF 处理技能:1.使用本文件夹中的extract_text.py脚本提取PDF中的文本:python3 extract_text.py 2.提取后,请以结构化格式总结要点。3、Skills的三个“魔法机关”Skills的核心架构,藏着3个“魔法机关”,彼此协同工作。比如,这是专门制作视频的Remotion skill的SKILL.md设置:---name: remotion-best-practicesdescription: Best practices for Remotion - Video creation in Reactmetadata:tags: remotion, video, react, animation, composition---## When to useUse this skills whenever you are dealing with Remotion code to obtain the domain-specific knowledge.## CaptionsWhen dealing with captions or subtitles, load the [./rules/subtitles.md](./rules/subtitles.md) file for more information.## Using FFmpegFor some video operations, such as trimming videos or detecting silence, FFmpeg should be used. Load the [./rules/ffmpeg.md](./rules/ffmpeg.md) file for more information.## Audio visualizationWhen needing to visualize audio (spectrum bars, waveforms, bass-reactive effects), load the [./rules/audio-visualization.md](./rules/audio-visualization.md) file for more information.## How to useRead individual rule files for detailed explanations and code examples:它主要靠三个聪明的“机关”来约束AI:机关一:智能开关(YAML元数据)每个Skill文件的开头(就是用—包裹的那块),都有一个小小的控制面板,这是Skills的元数据,会始终加载到Claude Code的系统提示中。这就好比技能的“开关”和“权限卡”。机关二:随用随取的“小抄”(渐进式披露)过去的AI有个毛病:记性不好。如果我们把公司的所有开发规范都塞给它,它的“短期记忆(上下文窗口)”瞬间就被撑爆了,导致它开始胡言乱语(AI幻觉)。Skills的设计非常聪明:平时绝不占用脑容量,只在需要时占用。你写好的几十个Skills,就像存放在书架上的工具书。Claude Code平时不去翻它们,只有当你触发了“测试代码”的技能时,Claude Code才会翻出小抄,只把关于“如何测试”的那张纸加载进大脑。内存省了,思路也无比清晰。机关三:呼叫外援与影分身(行动导向与子代理)Skills可不只是让AI读说明书,它还能让AI“动起手来”。在Skill的指导下,Claude Code可以像人类一样敲击命令行、搜索文件、运行测试。更有趣的是,如果它碰到了一个极其复杂的巨无霸任务,它可以召唤一个“子代理”(Subagent)——就像是它召唤了一个自己的“影分身”,让分身专门去隔壁房间解决那个大难题,搞定后再把结果汇报给自己。这里面,渐进式披露(Progressive Disclosure)是Skills最牛的的设计哲学。它让Skills的所有信息不是一次性塞给Claude Code,而是分三层加载,根据需要逐步展示。层级内容加载时机Token配额作用第一层元数据(name + description)始终在上下文中约100词决定skill何时触发第二层SKILL.md主体技能触发后<5000词核心工作流程第三层配套资源(scripts/references/assets)按需加载无限详细参考和可执行代码这种设计有什么好处?想象一下,你有一个包含数百页技术文档的Skill。如果每次对话都把这些文档加载进去,对话上下文(Context)很快就会被撑爆。但通过渐进式披露,Claude Code只在需要时才加载相关文档——就像一本组织良好的指南书,你只看需要的章节,而不是从头读到尾。4、Skills与Prompt、MCP、Agent、Projects的区别简单认识Skills后,相信你心中一定会有一个疑问:Skills和Prompt、MCP以及Agent、Projects他们之间到底有什么区别?这里,我简单做了张表,帮助大家理解。http://cdn.u1.huluxia.com/g4/M00/61/EF/rBAAdmndWh2AId81AACXSszKxpA271.png,1056,572 |
|