AI Agent Skill 深度研究报告
摘要: 本文系统回答了「什么是 AI Agent Skill?」这一核心问题。从定义与特征出发,详细解读华为云 SKILL.md 规范(frontmatter 格式、章节要求、目录结构、命名规则、质量门禁),从业界通用视角归纳 Skill 的 8 大能力类别(信息查询、事务操作、诊断分析、流程编排、监控告警、AI 调用、数据导出、合规治理),横向对比华为云、阿里云、MCP、OpenAI GPTs、AWS Bedrock、Azure Connectors 等 7 大平台的 Skill/插件设计差异,提炼出 5 个关键设计洞察(脚本优先架构、文档即代码、受控执行包装器、场景路由、三层诚实标注),并对 Skill 市场建设提出 4 条可落地的启示。
什么是 Skill?Skill 的规范是什么?能做什么?适用场景?业界如何设计?
一、什么是 AI Agent Skill
1.1 定义
AI Agent Skill(技能) 是一个自包含、可安装的能力扩展包,包含知识指令(SKILL.md)、参考文档(references/)和可执行脚本(scripts/),让 AI Agent 学会执行特定领域的工作。
它不是一段提示词,而是一个可安装、可审计、可版本管理的工程制品。
1.2 核心特征
| 特征 | 说明 |
|---|---|
| 自包含 | 一个目录就是一个 Skill:SKILL.md(指令)+ references/(文档)+ scripts/(代码) |
| 可安装 | 通过 npx skills add、skill_manage() 或目录放置即可加载 |
| 可发现 | YAML frontmatter 中的 name + description + 触发词让 Agent 自动识别何时激活 |
| 可组合 | 多个 Skill 共存,各管各的领域,互不冲突 |
| 可审计 | 每次脚本调用、参考文档读取、执行路径都可追溯 |
| 可版本化 | 遵循 semver 语义化版本控制 |
1.3 Skill 与相关概念的区分
| 概念 | 与 Skill 的区别 |
|---|---|
| Plugin(插件) | 插件通常是纯 API 封装(如 OpenAI Plugin = OpenAPI spec)。Skill 既包含文档又包含可执行脚本,不只是 API 包装器 |
| Tool(工具) | 工具是单一函数调用(如计算器、网页搜索)。Skill 是多步骤工作流,含路由、安全门禁、验证链、回退逻辑 |
| MCP Server | MCP 通过 JSON-RPC 暴露工具/资源,是网络服务。Skill 是本地知识+脚本包,无需网络 |
| Function Calling | 原生 LLM 函数调用传 JSON Schema 给模型——无持久状态、无工作流。Skill 用安全守卫 + 验证 + 文档上下文包装函数 |
| RAG 知识库 | RAG 是被动查找。Skill 是主动的:路由意图、执行脚本、验证结果 |
二、SKILL.md 规范(华为云标准)
2.1 文件格式
---
name: huawei-cloud-{product}-{function}
description: |-
1. {英文功能范围}。{CLI 要求}。
2. Triggered by: {触发词(中英文)}。
3. {价值主张——解决什么问题}。
4. Usage: {典型工作流,A → B → C 箭头表示}。
5. {前置条件——CLI 版本、认证方式、环境变量}。
tags: [huawei-cloud, {tag1}, {tag2}]
---
Frontmatter 仅 3 个字段:
name— 命名规范:huawei-cloud-{product}-{function}description— 编号列表格式(至少 5 行):范围、触发词、价值、工作流、前置条件tags— 分类标签数组
2.2 正文章节要求
| # | 章节 | 必需 | 说明 |
|---|---|---|---|
| 1 | 概述 | ✅ | 功能描述、适用场景、典型用例 |
| 2 | 前置条件 | ✅ | CLI 版本、认证配置、IAM 权限 |
| 3 | KooCLI 命令格式标准 | ⚠️ | 仅 CLI 类技能需要 |
| 4 | 核心命令 | ✅ | 按功能分组的命令或操作步骤 |
| 5 | 参数确认 | ✅ | 用户可配置的参数表 |
| 6 | 输出格式 | ★ | 返回结果的格式规范 |
| 7 | 验证方法 | ★ | 引用 references/verification-method.md |
| 8 | 最佳实践 | ★ | 使用建议 |
| 9 | 参考文档 | ✅ | 链接到 references/ 下各文档 |
| 10 | 注意事项 | ★ | 安全提示、已知限制 |
质量门禁:所有必需(✅)章节必须通过 + 推荐(★)章节 ≥ 80%。
2.3 目录结构
huawei-cloud-{product}-{function}/
├── SKILL.md # 必需——单一入口点
├── references/ # 必需
│ ├── cli-installation-guide.md # 必需(CLI 技能)
│ ├── iam-policies.md # 必需
│ ├── verification-method.md # 必需
│ └── ... # 其他参考文档
├── scripts/ # 可选——可执行脚本
├── templates/ # 可选——模板文件
└── tests/ # 可选——测试用例
2.4 命名规范
huawei-cloud-{product}-{function}
示例:huawei-cloud-ecs-query、huawei-cloud-vpc-operations、huawei-cloud-cce-metric-analyzer
产品域目录:小写英文(bss, computing, storage)
产品子目录:小写英文缩写(billing, ecs, obs)
参考文档:kebab-case(cli-installation-guide.md)
2.5 语言规则
| 文件 | 语言 |
|---|---|
| SKILL.md 正文 | 英文 |
| SKILL.md Frontmatter description | 英文(触发词可中文) |
| references/ 文档 | 英文 |
| 代码/命令示例 | 英文 |
| Script 文件头注释 | 英文 |
2.6 质量检查清单
必需通过项:
- SKILL.md 存在
- YAML frontmatter 含
name和description references/iam-policies.md存在- 必需章节:概述、前置条件、工作流、核心命令、参数确认
- 无硬编码凭据
- 无跨技能调用
强烈推荐项:
- 命名规范:
huawei-cloud-{product}-{function} - KooCLI 命令格式章节
references/cli-installation-guide.md存在
三、Skill 能做什么?能力与应用场景
Skill 的本质是将 Agent 从「通用对话」扩展到「专业执行」。不同平台对 Skill 的能力定义虽有差异,但核心应用场景可以归纳为以下 8 大类别。
3.1 信息查询与检索
最基础也是最广泛的能力——让 Agent 获取实时、准确的结构化数据。
| 场景 | 示例 | 典型平台 |
|---|---|---|
| 企业内部数据 | 查 CRM 客户信息、ERP 订单状态、HR 组织架构 | Salesforce Connector、SAP Skills |
| 云资源清单 | 查询虚拟机列表、存储空间用量、网络拓扑 | 华为云 ECS/VPC Skills、AWS Bedrock |
| 知识库检索 | 文档搜索、FAQ 匹配、技术手册查询 | RAG-based Skills、GPTs 知识检索 |
| 实时状态 | 服务健康检查、告警查询、监控指标 | Datadog Skills、CloudWatch Skills |
| 社交媒体 | 推文搜索、热度趋势、用户画像 | Twitter/X Skills、Reddit Skills |
典型工作流: 用户提问 → Skill 激活 → 构造查询 → 执行 API/命令 → 格式化结果 → 返回
3.2 创建与事务操作
Skill 让 Agent 从「只能读」变成「能写」——但要配合安全门禁。
| 场景 | 示例 | 安全要求 |
|---|---|---|
| 资源创建 | 创建云服务器、配置网络、开通数据库 | 费用确认、配额检查、Dry-run |
| 工单处理 | 提交审批、创建 Jira Issue、发起变更流程 | 权限校验、审批流 |
| 内容发布 | 发博客、更新网站、推送通知 | 内容审核、二次确认 |
| 订单操作 | 下单采购、充值续费、代金券发放 | 金额确认、风控拦截 |
| 配置变更 | 修改安全组规则、更新 DNS 记录、调整伸缩策略 | 风险评估、回滚方案 |
典型安全模式: 展示变更内容 → 要求用户确认 → 执行 → 回读验证 → 记录审计日志
3.3 分析诊断与排查
利用 Agent 的推理能力 + Skill 的数据获取能力,替代人工排查。
| 场景 | 示例 | 价值 |
|---|---|---|
| 日志分析 | 关键字搜索、异常检测、趋势分析 | 分钟级定位问题 |
| 性能诊断 | CPU/内存/网络瓶颈分析 | 自动出优化建议 |
| 错误排查 | 错误码解析、根因分析、修复建议 | 结构化分类,不靠猜 |
| 安全审计 | 登录记录分析、权限异常检测、合规扫描 | 自动生成安全报告 |
| 依赖分析 | 服务调用链追踪、依赖关系可视化 | 故障影响范围评估 |
与纯 LLM 的区别: 不靠模型「记忆」常见问题,而是 Skill 实际去查数据、跑诊断脚本,拿证据说话。
3.4 流程自动化与编排
Skill 可以串联多个步骤,形成完整的自动化工作流。
| 层次 | 说明 | 示例 |
|---|---|---|
| 单技能闭环 | 一个 Skill 完成从「查」到「修」到「验」的全链路 | 创建 ECS → 等待就绪 → 验证状态 → 配置 SSH → 部署应用 |
| 多技能编排 | 多个 Skill 协同完成跨领域任务 | VPC Skill + ECS Skill + DNS Skill 协同部署 Web 服务 |
| 人机协同 | 关键步骤交给用户决策,低级步骤自动执行 | 变更计划自动生成 → 用户确认 → 自动执行 → 结果报告 |
关键价值: 减少人在多个控制台之间切换的认知负担,Agent 记住上下文、维护状态、确保每一步顺序正确。
3.5 监控与告警
Skill 作为常驻监控点,定期检查系统状态并主动报告。
| 模式 | 说明 | 示例 |
|---|---|---|
| 轮询检查 | 定期执行查询,发现异常主动推送 | 每 5 分钟检查证书到期、磁盘超阈值 |
| 被动响应 | 用户问「现在怎么样」时即时查询 | 「帮我看看生产环境的 ECS 负载」 |
| 变更监测 | 监控配置变化,发现非预期变更 | 安全组规则被修改时告警 |
| 趋势分析 | 聚合历史数据,发现长期趋势 | 月度成本趋势、资源增长率 |
3.6 AI 能力调用
Skill 可以封装 AI 模型能力,让 Agent 做更多「生成类」任务。
| 能力 | 示例 | 平台 |
|---|---|---|
| 文本生成 | 写周报、生成 PRD、翻译、润色 | OpenAI GPTs、Claude Skills |
| 图片生成 | 文生图、图生图、风格迁移 | Midjourney Skills、MaaS Skills |
| 视频生成 | 文生视频、视频编辑 | Runway Skills、MaaS Skills |
| 语音处理 | 语音转文字、文字转语音、声音克隆 | Whisper Skills、ElevenLabs Skills |
| 代码生成 | 代码解释、重构、测试生成 | Codex Skills、Copilot Skills |
3.7 数据导出与报告
Skill 可以将分散的数据汇总为结构化报告。
| 输出格式 | 适用场景 | 示例 |
|---|---|---|
| HTML 报告 | 管理层汇报、详细分析 | 安全审计报告、成本分析报告 |
| Markdown | 开发文档、技术方案 | 架构分析、对比报告 |
| Excel/CSV | 数据透视、进一步分析 | 资源清单导出、账单明细 |
| 正式交付、打印归档 | 合规报告、验收报告 | |
| 图表/可视化 | 直观展示、决策支持 | 资源拓扑图、趋势折线图 |
3.8 合规治理与运营
Skill 帮助团队维持长期的治理标准。
| 场景 | 示例 |
|---|---|
| 资源盘点 | 全账户资源扫描、标签合规检查 |
| 成本治理 | 闲置资源识别、按需 vs 包月优化建议 |
| 安全基线 | 密码策略检查、日志留存合规、加密要求 |
| 容量规划 | 使用率趋势分析、扩容建议、预算预测 |
| SLA 管理 | 服务可用性计算、SLA 达标率报告 |
能力全景总结
Skill 能力层次
│
┌────────────────┼────────────────┐
│ │ │
被动响应 主动监控 主动编排
│ │ │
用户提问→Skill执行 定时触发→检查→报告 多技能协作→完成
│ │ │
─── 典型场景 ───────────────────────────
│ 信息查询 │ 事务操作 │ 诊断分析 │
│ 流程编排 │ 监控告警 │ AI 调用 │
│ 数据导出 │ 合规治理 │ │
──────────────────────────────────────
不同平台的 Skill 能力重点不同:华为云 Skills 侧重①④⑧(查询、编排、治理),MCP 侧重①②⑤(查询、分析、监控),OpenAI GPTs 侧重①②⑥(查询、事务、AI 调用)。但无论哪个平台,Skill 的核心价值都是把 Agent 从一个「聊天机器人」变成「领域专家」。
四、业界设计对比
4.1 生态对比总览
| 平台 | Skill 系统 | 格式 | 数量 | 分布 |
|---|---|---|---|---|
| 华为云 Skills | SKILL.md + references + scripts | Markdown + YAML frontmatter | 61+ 已发布 | AI、计算、网络、存储、容器、安全、财务、监控、DevOps |
| 阿里云 Agent Skills | SKILL.md 格式(类似) | Markdown + frontmatter | ~45 | 16 分类,云资源查询与管理 |
| MCP | MCP Server + tools/resources | JSON-RPC over stdio/HTTP | ~19 官方 | 文件系统、Git、GitHub、PostgreSQL、SQLite、Puppeteer、Memory、Web 搜索 |
| OpenAI GPTs/Plugins | OpenAPI spec + manifest.json | OpenAPI 3.0 + ai-plugin.json | 数千 | 各类 SaaS 集成 |
| Claude Code tools | 内置工具(终端、文件、网页) | 预装 | ~15 | 通用型 |
| Azure Connectors | 基于 OpenAPI 的连接器 | OpenAPI spec | 1,554 | SaaS 集成(Office 365、Dynamics),0 个基础设施操作 |
| AWS Bedrock Agents | Action Groups + Lambda | OpenAPI + Lambda | 0 个预置 | 用户自定义,无预置云操作 Skill |
4.2 多维度对比
| 维度 | 华为云 Skills | OpenAI GPTs | MCP | AWS Bedrock | Azure Connectors |
|---|---|---|---|---|---|
| 定位 | 云基础设施运维 | 通用 SaaS + 知识 | 文件系统 + 开发工具 | 用户自定义行动 | 企业 SaaS |
| 预置操作 | ✅ 61+ 云 Skill | ❌ 平台非预置 | ~19 参考实现 | ❌ 无 | 1,554 连接器 |
| 安全门禁 | ✅ Plan-first、Dry-run、用户确认 | ❌ 仅提示词 | ❌ 仅协议层 | ❌ Lambda/IAM 仅 | ❌ API 级别 |
| 脚本执行 | ✅ 一等公民(Python 脚本) | ❌ 不支持 | ❌ 不支持 | ✅ Lambda(用户自写) | ❌ 不支持 |
| 离线可用 | ✅ 本地脚本 + 文档 | ❌ 需要网络 | ✅ 本地 | ❌ 需要网络 | ❌ 需要网络 |
| 验证链 | ✅ Job→资源→业务→协议 | ❌ 无 | ❌ 无 | ❌ 无 | ❌ 无 |
| 文档即代码 | ✅ SKILL.md 既是文档又是运行指令 | ❌ 分离 | ❌ 分离 | ❌ 分离 | ❌ 分离 |
| 认证模型 | 环境变量 / hcloud profile | OAuth | API Key | IAM Roles | OAuth |
4.3 关键设计发现
华为云是基础设施 Agent Skill 的拓荒者
没有竞争对手提供预置的、即装即用的云基础设施操作 Skill。 AWS Bedrock 要求用户自己写 Lambda 函数。Azure 有 1,554 个连接器——但全部针对 SaaS 集成(Office 365、Salesforce),不是云资源操作。华为云的 61+ Skill 覆盖了云完整生命周期:计算、网络、存储、数据库、安全、财务、AI、DevOps。
脚本优先架构 vs 纯提示词
这是华为云 Skill 与其他生态最本质的安全差异:
| 方式 | Agent 如何决定运行什么 | 错误处理 | 安全 |
|---|---|---|---|
| 纯提示词 | Agent 凭记忆写 shell 命令 | Agent 试错式调试 | 无——Agent 可能猜错 |
| 脚本优先 | Agent 调用结构化脚本(discovery、query、safe_exec、change_plan) | 结构化错误分桶(auth、permission、param、quota、network) | Dry-run + 确认 + 验证 |
SKILL.md 的双重身份
SKILL.md 不是传统意义上的「文档」——它同时扮演两个角色:
- 文档:人类可读的安装指南、命令参考、最佳实践
- 运行时指令:告诉 Agent 何时激活、按什么工作流执行、调哪些脚本、遵守什么安全规则、如何验证结果
这与 OpenAPI 规范或普通 README 有本质区别——那些只有人类读,SKILL.md 是人机共读的。
五、Skill vs 其他 Agent 扩展机制
5.1 Skill vs MCP
| 方面 | Skills | MCP |
|---|---|---|
| 架构 | 本地文件系统 | 客户端-服务器 JSON-RPC |
| 传输 | 文件系统 | stdio、HTTP/SSE、WebSocket |
| 发现 | SKILL.md frontmatter | listTools RPC 调用 |
| 安全 | 脚本包装器 + 安全门禁 | 由服务端实现决定 |
| 离线 | ✅ 完全离线 | 取决于服务端 |
| 复杂度 | 安装 = 复制目录 | 运行服务进程 + 维持连接 |
| 最适合 | 云运维、脚本密集型工作流 | 文件系统、数据库、浏览器自动化 |
5.2 Skill vs OpenAI GPTs/Plugins
| 方面 | Skills | GPTs/Plugins |
|---|---|---|
| 定义格式 | SKILL.md(Markdown + YAML) | OpenAPI 3.0 + ai-plugin.json |
| 执行引擎 | Python 脚本(本地) | 远程 API 调用 |
| 状态管理 | 本地文件系统 | 无状态 HTTP |
| 认证 | 环境变量 / CLI profiles | OAuth、API Key |
| 安全 | Plan→Dry-run→确认→验证→报告 | OAuth scopes only |
| 离线 | ✅ 是 | ❌ 需要网络 |
| 成本 | 免费(本地脚本) | 服务托管 + API 费用 |
5.3 Skill vs AWS Bedrock Agents
| 方面 | Skills | Bedrock Agents |
|---|---|---|
| 预置操作 | ✅ 61+ 云 Skill | ❌ 零——用户自写 Lambda |
| 基础设施操作 | ✅ 聚焦云运维 | ❌ 无预置 |
| 安全门禁 | ✅ Guarded change flow | ❌ IAM only |
| 分发 | GitHub/GitCode 市场 | AWS 控制台 |
| 厂商锁定 | 可移植(任何 SSH Agent) | 深度 AWS 集成 |
六、总结与启示
6.1 核心结论
-
AI Agent Skill 是自包含、可安装的能力扩展包——结合指令(SKILL.md)、文档(references/)、可执行脚本(scripts/),与 Plugin(纯 API)、Tool(单函数)、MCP Server(网络协议)有本质区别。
-
SKILL.md 规范(华为云标准)定义了精确格式:3 字段 YAML frontmatter + 10 章正文(6 必需 + 4 推荐)+ 3 个必需参考文档。
-
能力覆盖云完整生命周期:资源管理、故障排查、成本优化、安全合规、AI 模型调用、Terraform/IaC、多步骤验证工作流。
-
华为云是基础设施 Agent Skill 的行业拓荒者(61+ 已发布)——AWS Bedrock 零预置、Azure Connectors 面向 SaaS 而非基础设施、MCP 约 19 个文件/开发工具。
-
5 个设计创新独一无二:
- 脚本优先架构(非纯提示词)保障安全
- SKILL.md 人机共读的双重身份
safe_exec受控执行包装器- 场景路由优于 API 端点发现
- 三层诚实标注机制
6.2 对 Skill 市场建设的启示
| 启示 | 说明 |
|---|---|
| 安全执行层应成为基础设施 | safe_exec 的脱敏、错误分类、输出策略应包装为通用组件,所有市场上架 Skill 强制接入 |
| 诚实标注应成为上架标准 | 三层标注(Curated/Metadata/Evidence-gap)作为必填项,用户知道每个 Skill 的实际可信任程度 |
| 场景路由可复用为技能发现 | 用户说一句话就推荐一组 Skill 组合,而不是搜关键词 |
| 脚本优先是差异化竞争力 | 其他生态都不做预置云操作 Skill,这是华为云市场的独特护城河 |
- 点赞
- 收藏
- 关注作者
评论(0)