Skip to content

阶段目标

每个 AI 核心能力都有专属的测试方法论。 Prompt 怎么系统化测试?RAG 检索质量怎么评估?Agent 多步推理怎么验证?MCP 工具链怎么保障?推理模型的 Thinking Token 怎么测?这里逐个攻破。

难度:进阶+ · 预计:10-14 小时 · 成果:专项评测方法全集


本阶段文章


学习建议

按顺序学习「AI 专项测试深入」阶段, 每篇都有实践案例。学完后可以回到 大模型测试体系首页 继续下一个阶段。