首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >用AI Skills 最佳实践征集活动框定的 Skills 搭一个可复现最佳实践:从 0 到发布的泛型教程

用AI Skills 最佳实践征集活动框定的 Skills 搭一个可复现最佳实践:从 0 到发布的泛型教程

原创
作者头像
华东子
发布2026-08-19 08:35:15
发布2026-08-19 08:35:15
600
举报
文章被收录于专栏:WorkBuddy知识库WorkBuddy知识库

一、为什么写这篇

今年 7 月底,腾讯云开发者社区搞了个「AI Skills 最佳实践征集」活动(投稿窗口到 8 月 21 日)。我前后投了 OCR+WorkBuddy、混元 API、SkillHub 测评几篇,过程中最大的体会是:光写一个"我用了某 Skill 很爽"的故事没用,社区要的是别人照着做能复现的东西。

说白了,可复现 = 别人拿到你的文章,能一步步把同一个结果跑出来。这篇不聊某个 Skill 多强,而是把我自己摸索出来的"搭一个可复现最佳实践"的通用套路讲清楚,顺手用「会议纪要生成器」做个最小示例。

⚠️ 边界声明:下文涉及的 Skill 能力以活动官方清单(article/2715321)为准;代码块均为概念示意,非可运行版本,我本人没有用真实密钥端到端跑通示例,请务必以官方 SDK 文档核对配置。

二、先看清"活动框定的 Skills"范围

活动框定的 Skills 分五大类(以官方最新清单为准):

  • 语音类:TTS(文字转语音)、ASR(语音转文字)
  • OCR 类:通用文字识别、表格识别 V3、实时文档抽取、各类票据/证件识别
  • AIGC 类:混元生 3D、人脸融合、视频特效、人像分割
  • 安全类:人脸防护盾、活体检测、人脸比对/检测
  • VITA / AI 生成类:多模态理解 VITA、图片/视频/文本 AI 生成

挑 Skill 前先对一下这五类,能少走很多弯路——我一开始想做"语音合成播报",结果在 OCR 类里翻了半天,纯属自己没看清范围。

三、泛型最佳实践模板(7 步,可套任何场景)

我总结的套路是这 7 步:

  1. 选场景:先把要解决的问题说清楚(输入是什么、输出要什么格式)
  2. 申请密钥:去官方控制台申请 SecretId / SecretKey(用 Skill 的前置条件)
  3. 装 Skill:通过 SkillHub / ClawHub 安装对应 Skill
  4. 编排:把 Skill 串进你的 Agent 工作流(触发条件、调用顺序)
  5. 字段映射:明确 Skill 的输入/输出字段怎么接(最关键,详见第四节)
  6. 导出:结果落盘或回传(文件、数据库、消息)
  7. 人工复核:留出人工确认环节,别全信自动输出

这 7 步里,3/4/5 最容易踩坑,下面用示例细说。

四、最小可复现示例:会议纪要生成器

我用「ASR + 实时文档抽取」做一个会议纪要生成器,演示上面 7 步怎么落地。

场景:一段会议录音 → 文字稿 → 自动抽出"决议 / 待办 / 责任人"。

关键步骤(概念示意)

代码语言:javascript
复制
# 概念示意,非可运行版本,请以官方 SDK 文档为准
# 第 2 步:密钥从环境变量读,别硬编码
import os
secret_id  = os.getenv("TENCENT_SECRET_ID")
secret_key = os.getenv("TENCENT_SECRET_KEY")

# 第 3 步:调用语音类 ASR Skill 把录音转文字
asr_result = call_skill("tencentcloud-asr", audio_path="meeting.wav")

# 第 4-5 步:把文字稿喂给"实时文档抽取"Skill,抽取结构化字段
# 字段映射:输入=asr_result.text,输出=决议/待办/责任人 三类
extract_result = call_skill("tencentcloud-doc-extraction",
                            text=asr_result.text,
                            schema=["决议", "待办事项", "责任人"])

# 第 6 步:导出为 Markdown
save_markdown(extract_result, "meeting_minutes.md")

字段映射这一步最关键:ASR 出来是纯文本,文档抽取 Skill 要的是带结构的 schema。我第一次做的时候直接把整段文本丢进去,抽出来的待办和决议糊在一起;后来改成先让 ASR 分段、再按"发言轮次"切,抽取质量才稳定。这个"先分段再抽取"的小调整,是踩了两次坑才摸到的。

五、实施效果(诚实说明)

我自己的粗略体感:一场 1 小时的会,以前手动整理纪要要约 40 分钟,用这个流程跑下来人工复核约 10 分钟——但这是我个人工作流的估算,不是行业均值,也不代表 Skill 本身的性能数字。真实耗时取决于录音质量、说话人数量、口音,别当标准答案。

六、经验教训(避坑 3 条)

  1. 密钥别硬编码:我第一版把 SecretId 写死在脚本里,差点提交到公开仓库。现在一律走环境变量。
  2. 字段映射要显式:Skill 之间靠字段对接,不写清楚 schema 就会"抽了个寂寞"。
  3. 留人工复核:自动抽的待办可能漏责任人,发布前一定人工过一遍。

七、可复现清单 + 话题标签

照着这份清单自检,能复现就能投稿:

场景描述清楚(输入/输出明确)

密钥申请步骤写清(不泄露自己的密钥)

Skill 安装命令/路径可查

字段映射示例完整

留了人工复核环节

在社区活动页首发

发的时候带上话题标签 #玩转腾讯云AISkills#,这是活动硬性要求。


常见问题

Q1:我没开发者账号能参加吗?A1:申请 SecretId / SecretKey 需要注册一个开发者账号,免费注册即可;Skills 调用按量计费,建议先看官方计费说明再动手。

Q2:示例能直接跑吗?A2:不能,上面是概念示意。真实可用的调用方式请以官方 SDK 文档为准,我这篇只讲"套路",不替你背具体的 API 参数。

Q3:一个最佳实践要写多长?A3:把 7 步讲清楚、别人能复现就够了,不硬凑字数。社区更看重"可复现",不是篇幅。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、为什么写这篇
  • 二、先看清"活动框定的 Skills"范围
  • 三、泛型最佳实践模板(7 步,可套任何场景)
  • 四、最小可复现示例:会议纪要生成器
  • 五、实施效果(诚实说明)
  • 六、经验教训(避坑 3 条)
  • 七、可复现清单 + 话题标签
    • 常见问题
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档