
今年 7 月底,腾讯云开发者社区搞了个「AI Skills 最佳实践征集」活动(投稿窗口到 8 月 21 日)。我前后投了 OCR+WorkBuddy、混元 API、SkillHub 测评几篇,过程中最大的体会是:光写一个"我用了某 Skill 很爽"的故事没用,社区要的是别人照着做能复现的东西。

说白了,可复现 = 别人拿到你的文章,能一步步把同一个结果跑出来。这篇不聊某个 Skill 多强,而是把我自己摸索出来的"搭一个可复现最佳实践"的通用套路讲清楚,顺手用「会议纪要生成器」做个最小示例。
⚠️ 边界声明:下文涉及的 Skill 能力以活动官方清单(article/2715321)为准;代码块均为概念示意,非可运行版本,我本人没有用真实密钥端到端跑通示例,请务必以官方 SDK 文档核对配置。
活动框定的 Skills 分五大类(以官方最新清单为准):
挑 Skill 前先对一下这五类,能少走很多弯路——我一开始想做"语音合成播报",结果在 OCR 类里翻了半天,纯属自己没看清范围。
我总结的套路是这 7 步:
这 7 步里,3/4/5 最容易踩坑,下面用示例细说。
我用「ASR + 实时文档抽取」做一个会议纪要生成器,演示上面 7 步怎么落地。
场景:一段会议录音 → 文字稿 → 自动抽出"决议 / 待办 / 责任人"。
关键步骤(概念示意):
# 概念示意,非可运行版本,请以官方 SDK 文档为准
# 第 2 步:密钥从环境变量读,别硬编码
import os
secret_id = os.getenv("TENCENT_SECRET_ID")
secret_key = os.getenv("TENCENT_SECRET_KEY")
# 第 3 步:调用语音类 ASR Skill 把录音转文字
asr_result = call_skill("tencentcloud-asr", audio_path="meeting.wav")
# 第 4-5 步:把文字稿喂给"实时文档抽取"Skill,抽取结构化字段
# 字段映射:输入=asr_result.text,输出=决议/待办/责任人 三类
extract_result = call_skill("tencentcloud-doc-extraction",
text=asr_result.text,
schema=["决议", "待办事项", "责任人"])
# 第 6 步:导出为 Markdown
save_markdown(extract_result, "meeting_minutes.md")字段映射这一步最关键:ASR 出来是纯文本,文档抽取 Skill 要的是带结构的 schema。我第一次做的时候直接把整段文本丢进去,抽出来的待办和决议糊在一起;后来改成先让 ASR 分段、再按"发言轮次"切,抽取质量才稳定。这个"先分段再抽取"的小调整,是踩了两次坑才摸到的。
我自己的粗略体感:一场 1 小时的会,以前手动整理纪要要约 40 分钟,用这个流程跑下来人工复核约 10 分钟——但这是我个人工作流的估算,不是行业均值,也不代表 Skill 本身的性能数字。真实耗时取决于录音质量、说话人数量、口音,别当标准答案。
照着这份清单自检,能复现就能投稿:
场景描述清楚(输入/输出明确)
密钥申请步骤写清(不泄露自己的密钥)
Skill 安装命令/路径可查
字段映射示例完整
留了人工复核环节
在社区活动页首发
发的时候带上话题标签 #玩转腾讯云AISkills#,这是活动硬性要求。
Q1:我没开发者账号能参加吗?A1:申请 SecretId / SecretKey 需要注册一个开发者账号,免费注册即可;Skills 调用按量计费,建议先看官方计费说明再动手。
Q2:示例能直接跑吗?A2:不能,上面是概念示意。真实可用的调用方式请以官方 SDK 文档为准,我这篇只讲"套路",不替你背具体的 API 参数。
Q3:一个最佳实践要写多长?A3:把 7 步讲清楚、别人能复现就够了,不硬凑字数。社区更看重"可复现",不是篇幅。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。