
2026 年人人会喊 Agent,可上线仍卡在同一句:Prompt 调得再花,过不了生产。

《Agent渡劫48关》 钉死 多租户客服 / 退款 一条主线:从「算不算 Agent」打到「一条退款讲完整个平台」。每关一文一视频,标题可转发,入口直接点开。
时间紧先渡这 12 关(对照 2026 生产四件套:Tool · RAG · MCP · Eval):
你卡在哪 | 先打 |
|---|---|
还在调 Prompt / 不会选 Tool | 第 1、3、5 关 |
RAG 像抽奖、租户敢不敢上 | 第 11、14、20 关 |
自动退款怕重试、要人审 | 第 22、26 关 |
没证据、没评测、不敢发版 | 第 29、31 关 |
工具散落、想平台化 | 第 44、48 关 |
热点能力 | 你带走的判断 | 关数 |
|---|---|---|
Agent / Tool | Loop、选型、参数、失败收场,别无限转 | 1~8 |
Agentic RAG | 不是 TopK:治理、Chunk、Metadata、多路召回、Rerank、租户隔离 | 9~20 |
Guardrail / HITL | 规则 vs LLM、幂等、超时、部分成功、人工闸、注入 | 21~28 |
Trace / Eval | Bad Case > 再调 Prompt;Golden / Judge / 成本 / CI | 29~36 |
LoRA / MCP | 微调准入;MCP、Gateway、数字人、演练、总复盘 | 37~48 |
过关标准一句话:退款能跑通,失败能恢复,链路能 Trace,改动能 Eval,工具能 MCP。

每层结束用自己业务写三张纸:失败分类 / 证据链 / 回归用例。写不出,别进下一层——那正是 Prompt 过不了生产的根因。

层 | 关数 | 这一层打什么 | 对齐热点 |
|---|---|---|---|
A. Agent 本体 | 1~8 | 是不是 Agent;请求链;Tool 选型/参数/失败;Loop;State/Context/Memory;长上下文 | Tool Calling |
B. 企业 RAG | 9~20 | 数据治理;Chunk;Metadata;Embedding;多路召回;改写;Rerank;TopK;排障;索引版本;多租户 | Agentic RAG |
C. 写操作与安全 | 21~28 | 规则边界;Retry/幂等;Timeout;部分成功;持久化任务;HITL;兜底;Prompt Injection | Guardrails |
D. 观测与发布 | 29~36 | Trace;Bad Case;评什么;数据集;Judge;延迟;成本;CI/CD | Eval / Observability |
E. 微调 | 37~42 | 该不该微调;数据;LoRA;Rank;过拟合;灾难性遗忘 | LoRA 准入 |
F. 平台与收口 | 43~48 | 别复制代码;MCP;多模型 Gateway;数字人;故意搞坏;一条退款讲完平台 | MCP / Platform |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
1 | Agent渡劫48关-第1关-客服Agent到底是不是Agent? | ||
2 | Agent渡劫48关-第2关-一次Agent请求内部到底发生了什么? | ||
3 | Agent渡劫48关-第3关-模型为什么会选择这个Tool? | ||
4 | Agent渡劫48关-第4关-Tool参数为什么最容易在线上出问题? | ||
5 | Agent渡劫48关-第5关-Tool调用失败以后Agent到底怎么办? | ||
6 | Agent渡劫48关-第6关-Agent Loop为什么不能无限运行? | ||
7 | Agent渡劫48关-第7关-State、Context、Memory到底有什么区别? | ||
8 | Agent渡劫48关-第8关-长上下文为什么不是越长越好? |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
9 | Agent渡劫48关-第9关-企业知识进入RAG前为什么先要治理数据? | ||
10 | Agent渡劫48关-第10关-Chunk到底应该切多大? | ||
11 | Agent渡劫48关-第11关-Metadata为什么可能比Embedding更重要? | ||
12 | Agent渡劫48关-第12关-Embedding模型到底影响了什么? | ||
13 | Agent渡劫48关-第13关-Vector Search为什么只是Recall的一种方式? | ||
14 | Agent渡劫48关-第14关-为什么企业RAG通常需要多路召回? | ||
15 | Agent渡劫48关-第15关-用户不会按照知识库语言提问怎么办? | ||
16 | Agent渡劫48关-第16关-为什么召回正确文档以后还需要Rerank? | ||
17 | Agent渡劫48关-第17关-TopK为什么不是越大越好? | ||
18 | Agent渡劫48关-第18关-RAG回答错误到底应该从哪里开始查? | ||
19 | Agent渡劫48关-第19关-知识更新以后老向量到底怎么办? | ||
20 | Agent渡劫48关-第20关-多租户RAG怎样才能真正不串数据? |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
21 | Agent渡劫48关-第21关-什么应该让LLM决策,什么必须交给规则? | ||
22 | Agent渡劫48关-第22关-Agent自动退款为什么最怕Retry? | ||
23 | Agent渡劫48关-第23关-Tool Timeout以后到底能不能重新执行? | ||
24 | Agent渡劫48关-第24关-部分成功以后到底怎么收场? | ||
25 | Agent渡劫48关-第25关-Agent服务挂了以后任务还能继续吗? | ||
26 | Agent渡劫48关-第26关-Human-in-the-loop到底应该放在哪里? | ||
27 | Agent渡劫48关-第27关-模型判断错误到底怎么兜底? | ||
28 | Agent渡劫48关-第28关-Prompt Injection为什么会变成业务安全问题? |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
29 | Agent渡劫48关-第29关-没有Trace为什么几乎没法调Agent? | ||
30 | Agent渡劫48关-第30关-Bad Case为什么比“继续优化Prompt”更重要? | ||
31 | Agent渡劫48关-第31关-Agent到底应该评什么? | ||
32 | Agent渡劫48关-第32关-Golden Set、Bad Case、Regression Set到底怎么建设? | ||
33 | Agent渡劫48关-第33关-LLM-as-a-Judge为什么不能什么都判? | ||
34 | Agent渡劫48关-第34关-Agent响应8秒到底慢在哪里? | ||
35 | Agent渡劫48关-第35关-成本优化为什么不能只盯Token? | ||
36 | Agent渡劫48关-第36关-Agent到底应该怎样做CI/CD? |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
37 | Agent渡劫48关-第37关-什么时候根本不应该微调? | ||
38 | Agent渡劫48关-第38关-训练数据为什么比LoRA参数更重要? | ||
39 | Agent渡劫48关-第39关-LoRA为什么能降低微调成本? | ||
40 | Agent渡劫48关-第40关-LoRA的Rank到底应该怎么选? | ||
41 | Agent渡劫48关-第41关-怎么判断模型已经过拟合了? | ||
42 | Agent渡劫48关-第42关-怎么防止微调以后模型忘掉原能力? |
关 | 完整标题 | 文章 | 视频 |
|---|---|---|---|
43 | Agent渡劫48关-第43关-为什么一个Agent成功以后不能复制代码做十个? | ||
44 | Agent渡劫48关-第44关-MCP在Agent Platform里到底解决什么问题? | ||
45 | Agent渡劫48关-第45关-多模型Gateway到底应该怎么设计? | ||
46 | Agent渡劫48关-第46关-数字人怎样才能成为Agent的实时入口? | ||
47 | Agent渡劫48关-第47关-为什么要故意把客服Agent搞坏一次? | ||
48 | Agent渡劫48关-第48关-一条退款请求怎样讲完整个Agent平台? |
Prompt 调得再漂亮,过不了这 48 关,就别叫生产 Agent。
从第 1 关开始渡。48 关文章与视频入口均已齐。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。