AI Agent Skill 深度研究报告

举报
gitCode-jie 发表于 2026/07/27 09:26:48 2026/07/27
【摘要】 本文系统回答了「什么是 AI Agent Skill?」这一核心问题。从定义与特征出发,详细解读华为云 SKILL.md 规范(frontmatter 格式、章节要求、目录结构、命名规则、质量门禁),从业界通用视角归纳 Skill 的 8 大能力类别(信息查询、事务操作、诊断分析、流程编排、监控告警、AI 调用、数据导出、合规治理),横向对比华为云、阿里云、MCP、OpenAI GPTs、AWS

摘要: 本文系统回答了「什么是 AI Agent Skill?」这一核心问题。从定义与特征出发,详细解读华为云 SKILL.md 规范(frontmatter 格式、章节要求、目录结构、命名规则、质量门禁),从业界通用视角归纳 Skill 的 8 大能力类别(信息查询、事务操作、诊断分析、流程编排、监控告警、AI 调用、数据导出、合规治理),横向对比华为云、阿里云、MCP、OpenAI GPTs、AWS Bedrock、Azure Connectors 等 7 大平台的 Skill/插件设计差异,提炼出 5 个关键设计洞察(脚本优先架构、文档即代码、受控执行包装器、场景路由、三层诚实标注),并对 Skill 市场建设提出 4 条可落地的启示。
什么是 Skill?Skill 的规范是什么?能做什么?适用场景?业界如何设计?


一、什么是 AI Agent Skill

1.1 定义

AI Agent Skill(技能) 是一个自包含、可安装的能力扩展包,包含知识指令(SKILL.md)、参考文档(references/)和可执行脚本(scripts/),让 AI Agent 学会执行特定领域的工作。

它不是一段提示词,而是一个可安装、可审计、可版本管理的工程制品。

1.2 核心特征

特征 说明
自包含 一个目录就是一个 Skill:SKILL.md(指令)+ references/(文档)+ scripts/(代码)
可安装 通过 npx skills addskill_manage() 或目录放置即可加载
可发现 YAML frontmatter 中的 name + description + 触发词让 Agent 自动识别何时激活
可组合 多个 Skill 共存,各管各的领域,互不冲突
可审计 每次脚本调用、参考文档读取、执行路径都可追溯
可版本化 遵循 semver 语义化版本控制

1.3 Skill 与相关概念的区分

概念 与 Skill 的区别
Plugin(插件) 插件通常是纯 API 封装(如 OpenAI Plugin = OpenAPI spec)。Skill 既包含文档又包含可执行脚本,不只是 API 包装器
Tool(工具) 工具是单一函数调用(如计算器、网页搜索)。Skill 是多步骤工作流,含路由、安全门禁、验证链、回退逻辑
MCP Server MCP 通过 JSON-RPC 暴露工具/资源,是网络服务。Skill 是本地知识+脚本包,无需网络
Function Calling 原生 LLM 函数调用传 JSON Schema 给模型——无持久状态、无工作流。Skill 用安全守卫 + 验证 + 文档上下文包装函数
RAG 知识库 RAG 是被动查找。Skill 是主动的:路由意图、执行脚本、验证结果

二、SKILL.md 规范(华为云标准)

2.1 文件格式

---
name: huawei-cloud-{product}-{function}
description: |-
  1. {英文功能范围}{CLI 要求}2. Triggered by: {触发词(中英文)}。
  3. {价值主张——解决什么问题}4. Usage: {典型工作流,A → B → C 箭头表示}。
  5. {前置条件——CLI 版本、认证方式、环境变量}tags: [huawei-cloud, {tag1}, {tag2}]
---

Frontmatter 仅 3 个字段:

  • name — 命名规范:huawei-cloud-{product}-{function}
  • description编号列表格式(至少 5 行):范围、触发词、价值、工作流、前置条件
  • tags — 分类标签数组

2.2 正文章节要求

# 章节 必需 说明
1 概述 功能描述、适用场景、典型用例
2 前置条件 CLI 版本、认证配置、IAM 权限
3 KooCLI 命令格式标准 ⚠️ 仅 CLI 类技能需要
4 核心命令 按功能分组的命令或操作步骤
5 参数确认 用户可配置的参数表
6 输出格式 返回结果的格式规范
7 验证方法 引用 references/verification-method.md
8 最佳实践 使用建议
9 参考文档 链接到 references/ 下各文档
10 注意事项 安全提示、已知限制

质量门禁:所有必需(✅)章节必须通过 + 推荐(★)章节 ≥ 80%。

2.3 目录结构

huawei-cloud-{product}-{function}/
├── SKILL.md                           # 必需——单一入口点
├── references/                        # 必需
│   ├── cli-installation-guide.md      # 必需(CLI 技能)
│   ├── iam-policies.md                # 必需
│   ├── verification-method.md         # 必需
│   └── ...                            # 其他参考文档
├── scripts/                           # 可选——可执行脚本
├── templates/                         # 可选——模板文件
└── tests/                             # 可选——测试用例

2.4 命名规范

huawei-cloud-{product}-{function}
示例:huawei-cloud-ecs-query、huawei-cloud-vpc-operations、huawei-cloud-cce-metric-analyzer
产品域目录:小写英文(bss, computing, storage)
产品子目录:小写英文缩写(billing, ecs, obs)
参考文档:kebab-case(cli-installation-guide.md)

2.5 语言规则

文件 语言
SKILL.md 正文 英文
SKILL.md Frontmatter description 英文(触发词可中文)
references/ 文档 英文
代码/命令示例 英文
Script 文件头注释 英文

2.6 质量检查清单

必需通过项:

  • SKILL.md 存在
  • YAML frontmatter 含 namedescription
  • references/iam-policies.md 存在
  • 必需章节:概述、前置条件、工作流、核心命令、参数确认
  • 无硬编码凭据
  • 无跨技能调用

强烈推荐项:

  • 命名规范:huawei-cloud-{product}-{function}
  • KooCLI 命令格式章节
  • references/cli-installation-guide.md 存在

三、Skill 能做什么?能力与应用场景

Skill 的本质是将 Agent 从「通用对话」扩展到「专业执行」。不同平台对 Skill 的能力定义虽有差异,但核心应用场景可以归纳为以下 8 大类别。

3.1 信息查询与检索

最基础也是最广泛的能力——让 Agent 获取实时、准确的结构化数据。

场景 示例 典型平台
企业内部数据 查 CRM 客户信息、ERP 订单状态、HR 组织架构 Salesforce Connector、SAP Skills
云资源清单 查询虚拟机列表、存储空间用量、网络拓扑 华为云 ECS/VPC Skills、AWS Bedrock
知识库检索 文档搜索、FAQ 匹配、技术手册查询 RAG-based Skills、GPTs 知识检索
实时状态 服务健康检查、告警查询、监控指标 Datadog Skills、CloudWatch Skills
社交媒体 推文搜索、热度趋势、用户画像 Twitter/X Skills、Reddit Skills

典型工作流: 用户提问 → Skill 激活 → 构造查询 → 执行 API/命令 → 格式化结果 → 返回

3.2 创建与事务操作

Skill 让 Agent 从「只能读」变成「能写」——但要配合安全门禁。

场景 示例 安全要求
资源创建 创建云服务器、配置网络、开通数据库 费用确认、配额检查、Dry-run
工单处理 提交审批、创建 Jira Issue、发起变更流程 权限校验、审批流
内容发布 发博客、更新网站、推送通知 内容审核、二次确认
订单操作 下单采购、充值续费、代金券发放 金额确认、风控拦截
配置变更 修改安全组规则、更新 DNS 记录、调整伸缩策略 风险评估、回滚方案

典型安全模式: 展示变更内容 → 要求用户确认 → 执行 → 回读验证 → 记录审计日志

3.3 分析诊断与排查

利用 Agent 的推理能力 + Skill 的数据获取能力,替代人工排查。

场景 示例 价值
日志分析 关键字搜索、异常检测、趋势分析 分钟级定位问题
性能诊断 CPU/内存/网络瓶颈分析 自动出优化建议
错误排查 错误码解析、根因分析、修复建议 结构化分类,不靠猜
安全审计 登录记录分析、权限异常检测、合规扫描 自动生成安全报告
依赖分析 服务调用链追踪、依赖关系可视化 故障影响范围评估

与纯 LLM 的区别: 不靠模型「记忆」常见问题,而是 Skill 实际去查数据、跑诊断脚本,拿证据说话。

3.4 流程自动化与编排

Skill 可以串联多个步骤,形成完整的自动化工作流。

层次 说明 示例
单技能闭环 一个 Skill 完成从「查」到「修」到「验」的全链路 创建 ECS → 等待就绪 → 验证状态 → 配置 SSH → 部署应用
多技能编排 多个 Skill 协同完成跨领域任务 VPC Skill + ECS Skill + DNS Skill 协同部署 Web 服务
人机协同 关键步骤交给用户决策,低级步骤自动执行 变更计划自动生成 → 用户确认 → 自动执行 → 结果报告

关键价值: 减少人在多个控制台之间切换的认知负担,Agent 记住上下文、维护状态、确保每一步顺序正确。

3.5 监控与告警

Skill 作为常驻监控点,定期检查系统状态并主动报告。

模式 说明 示例
轮询检查 定期执行查询,发现异常主动推送 每 5 分钟检查证书到期、磁盘超阈值
被动响应 用户问「现在怎么样」时即时查询 「帮我看看生产环境的 ECS 负载」
变更监测 监控配置变化,发现非预期变更 安全组规则被修改时告警
趋势分析 聚合历史数据,发现长期趋势 月度成本趋势、资源增长率

3.6 AI 能力调用

Skill 可以封装 AI 模型能力,让 Agent 做更多「生成类」任务。

能力 示例 平台
文本生成 写周报、生成 PRD、翻译、润色 OpenAI GPTs、Claude Skills
图片生成 文生图、图生图、风格迁移 Midjourney Skills、MaaS Skills
视频生成 文生视频、视频编辑 Runway Skills、MaaS Skills
语音处理 语音转文字、文字转语音、声音克隆 Whisper Skills、ElevenLabs Skills
代码生成 代码解释、重构、测试生成 Codex Skills、Copilot Skills

3.7 数据导出与报告

Skill 可以将分散的数据汇总为结构化报告。

输出格式 适用场景 示例
HTML 报告 管理层汇报、详细分析 安全审计报告、成本分析报告
Markdown 开发文档、技术方案 架构分析、对比报告
Excel/CSV 数据透视、进一步分析 资源清单导出、账单明细
PDF 正式交付、打印归档 合规报告、验收报告
图表/可视化 直观展示、决策支持 资源拓扑图、趋势折线图

3.8 合规治理与运营

Skill 帮助团队维持长期的治理标准。

场景 示例
资源盘点 全账户资源扫描、标签合规检查
成本治理 闲置资源识别、按需 vs 包月优化建议
安全基线 密码策略检查、日志留存合规、加密要求
容量规划 使用率趋势分析、扩容建议、预算预测
SLA 管理 服务可用性计算、SLA 达标率报告

能力全景总结

                         Skill 能力层次
                             │
            ┌────────────────┼────────────────┐
            │                │                │
        被动响应          主动监控         主动编排
            │                │                │
    用户提问→Skill执行  定时触发→检查→报告  多技能协作→完成
            │                │                │
     ─── 典型场景 ───────────────────────────
    │ 信息查询   │ 事务操作   │ 诊断分析   │
    │ 流程编排   │ 监控告警   │ AI 调用    │
    │ 数据导出   │ 合规治理   │            │
     ──────────────────────────────────────

不同平台的 Skill 能力重点不同:华为云 Skills 侧重①④⑧(查询、编排、治理),MCP 侧重①②⑤(查询、分析、监控),OpenAI GPTs 侧重①②⑥(查询、事务、AI 调用)。但无论哪个平台,Skill 的核心价值都是把 Agent 从一个「聊天机器人」变成「领域专家」


四、业界设计对比

4.1 生态对比总览

平台 Skill 系统 格式 数量 分布
华为云 Skills SKILL.md + references + scripts Markdown + YAML frontmatter 61+ 已发布 AI、计算、网络、存储、容器、安全、财务、监控、DevOps
阿里云 Agent Skills SKILL.md 格式(类似) Markdown + frontmatter ~45 16 分类,云资源查询与管理
MCP MCP Server + tools/resources JSON-RPC over stdio/HTTP ~19 官方 文件系统、Git、GitHub、PostgreSQL、SQLite、Puppeteer、Memory、Web 搜索
OpenAI GPTs/Plugins OpenAPI spec + manifest.json OpenAPI 3.0 + ai-plugin.json 数千 各类 SaaS 集成
Claude Code tools 内置工具(终端、文件、网页) 预装 ~15 通用型
Azure Connectors 基于 OpenAPI 的连接器 OpenAPI spec 1,554 SaaS 集成(Office 365、Dynamics),0 个基础设施操作
AWS Bedrock Agents Action Groups + Lambda OpenAPI + Lambda 0 个预置 用户自定义,无预置云操作 Skill

4.2 多维度对比

维度 华为云 Skills OpenAI GPTs MCP AWS Bedrock Azure Connectors
定位 云基础设施运维 通用 SaaS + 知识 文件系统 + 开发工具 用户自定义行动 企业 SaaS
预置操作 ✅ 61+ 云 Skill ❌ 平台非预置 ~19 参考实现 ❌ 无 1,554 连接器
安全门禁 ✅ Plan-first、Dry-run、用户确认 ❌ 仅提示词 ❌ 仅协议层 ❌ Lambda/IAM 仅 ❌ API 级别
脚本执行 ✅ 一等公民(Python 脚本) ❌ 不支持 ❌ 不支持 ✅ Lambda(用户自写) ❌ 不支持
离线可用 ✅ 本地脚本 + 文档 ❌ 需要网络 ✅ 本地 ❌ 需要网络 ❌ 需要网络
验证链 ✅ Job→资源→业务→协议 ❌ 无 ❌ 无 ❌ 无 ❌ 无
文档即代码 SKILL.md 既是文档又是运行指令 ❌ 分离 ❌ 分离 ❌ 分离 ❌ 分离
认证模型 环境变量 / hcloud profile OAuth API Key IAM Roles OAuth

4.3 关键设计发现

华为云是基础设施 Agent Skill 的拓荒者

没有竞争对手提供预置的、即装即用的云基础设施操作 Skill。 AWS Bedrock 要求用户自己写 Lambda 函数。Azure 有 1,554 个连接器——但全部针对 SaaS 集成(Office 365、Salesforce),不是云资源操作。华为云的 61+ Skill 覆盖了云完整生命周期:计算、网络、存储、数据库、安全、财务、AI、DevOps。

脚本优先架构 vs 纯提示词

这是华为云 Skill 与其他生态最本质的安全差异:

方式 Agent 如何决定运行什么 错误处理 安全
纯提示词 Agent 凭记忆写 shell 命令 Agent 试错式调试 无——Agent 可能猜错
脚本优先 Agent 调用结构化脚本(discovery、query、safe_exec、change_plan) 结构化错误分桶(auth、permission、param、quota、network) Dry-run + 确认 + 验证

SKILL.md 的双重身份

SKILL.md 不是传统意义上的「文档」——它同时扮演两个角色:

  1. 文档:人类可读的安装指南、命令参考、最佳实践
  2. 运行时指令:告诉 Agent 何时激活、按什么工作流执行、调哪些脚本、遵守什么安全规则、如何验证结果

这与 OpenAPI 规范或普通 README 有本质区别——那些只有人类读,SKILL.md人机共读的。

五、Skill vs 其他 Agent 扩展机制

5.1 Skill vs MCP

方面 Skills MCP
架构 本地文件系统 客户端-服务器 JSON-RPC
传输 文件系统 stdio、HTTP/SSE、WebSocket
发现 SKILL.md frontmatter listTools RPC 调用
安全 脚本包装器 + 安全门禁 由服务端实现决定
离线 ✅ 完全离线 取决于服务端
复杂度 安装 = 复制目录 运行服务进程 + 维持连接
最适合 云运维、脚本密集型工作流 文件系统、数据库、浏览器自动化

5.2 Skill vs OpenAI GPTs/Plugins

方面 Skills GPTs/Plugins
定义格式 SKILL.md(Markdown + YAML) OpenAPI 3.0 + ai-plugin.json
执行引擎 Python 脚本(本地) 远程 API 调用
状态管理 本地文件系统 无状态 HTTP
认证 环境变量 / CLI profiles OAuth、API Key
安全 Plan→Dry-run→确认→验证→报告 OAuth scopes only
离线 ✅ 是 ❌ 需要网络
成本 免费(本地脚本) 服务托管 + API 费用

5.3 Skill vs AWS Bedrock Agents

方面 Skills Bedrock Agents
预置操作 ✅ 61+ 云 Skill ❌ 零——用户自写 Lambda
基础设施操作 ✅ 聚焦云运维 ❌ 无预置
安全门禁 ✅ Guarded change flow ❌ IAM only
分发 GitHub/GitCode 市场 AWS 控制台
厂商锁定 可移植(任何 SSH Agent) 深度 AWS 集成

六、总结与启示

6.1 核心结论

  1. AI Agent Skill 是自包含、可安装的能力扩展包——结合指令(SKILL.md)、文档(references/)、可执行脚本(scripts/),与 Plugin(纯 API)、Tool(单函数)、MCP Server(网络协议)有本质区别。

  2. SKILL.md 规范(华为云标准)定义了精确格式:3 字段 YAML frontmatter + 10 章正文(6 必需 + 4 推荐)+ 3 个必需参考文档。

  3. 能力覆盖云完整生命周期:资源管理、故障排查、成本优化、安全合规、AI 模型调用、Terraform/IaC、多步骤验证工作流。

  4. 华为云是基础设施 Agent Skill 的行业拓荒者(61+ 已发布)——AWS Bedrock 零预置、Azure Connectors 面向 SaaS 而非基础设施、MCP 约 19 个文件/开发工具。

  5. 5 个设计创新独一无二

    • 脚本优先架构(非纯提示词)保障安全
    • SKILL.md 人机共读的双重身份
    • safe_exec 受控执行包装器
    • 场景路由优于 API 端点发现
    • 三层诚实标注机制

6.2 对 Skill 市场建设的启示

启示 说明
安全执行层应成为基础设施 safe_exec 的脱敏、错误分类、输出策略应包装为通用组件,所有市场上架 Skill 强制接入
诚实标注应成为上架标准 三层标注(Curated/Metadata/Evidence-gap)作为必填项,用户知道每个 Skill 的实际可信任程度
场景路由可复用为技能发现 用户说一句话就推荐一组 Skill 组合,而不是搜关键词
脚本优先是差异化竞争力 其他生态都不做预置云操作 Skill,这是华为云市场的独特护城河

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。