阶段目标
每个 AI 核心能力都有专属的测试方法论。 Prompt 怎么系统化测试?RAG 检索质量怎么评估?Agent 多步推理怎么验证?MCP 工具链怎么保障?推理模型的 Thinking Token 怎么测?这里逐个攻破。
难度:进阶+ · 预计:10-14 小时 · 成果:专项评测方法全集
本阶段文章
- 16 Prompt 工程与测试
- 17 RAG 专项评测
- 18 Agent 测试专项
- 19 LangChain 从入门到实战
- 20 LangGraph 从入门到实战
- 21 Transformer 与训练原理专项
- 22 幻觉检测专项
- 23 安全测试与红队
- 24 MCP 测试专项
- 25 推理模型测试专项
学习建议
按顺序学习「AI 专项测试深入」阶段, 每篇都有实践案例。学完后可以回到 大模型测试体系首页 继续下一个阶段。