Appearance
Large Model Testing System
从 AI 认知到高级评测科学,一套完整的大模型测试学习体系。覆盖功能、接口、性能、专项、架构、评测工程化、模型底层原理与前沿安全合规。
大模型基础认知、Python 入门与 AI API 实操、测试技术概览
AI 产品功能测试基础、实战与多模态专项
HTTP/REST、SSE、Tool Calling、MCP 协议级接口测试
压测指标、TTFT/吞吐/成本、多模态与 Agent 性能前沿
Prompt、RAG、Agent、LangChain、幻觉检测、安全红队、MCP 与推理模型专项
SDK、Web、移动端、H5 多端 AI 应用测试
LLM 应用架构、链路追踪与可观测性
评测 Pipeline、CI/CD、自动化测试方案与质量度量汇报
Tokenizer、Embedding、Transformer、训练目标与解码采样原理
幻觉机理、Judge 校准、线上流量闭环与 Agent 轨迹鲁棒性
偏见公平、数据隐私与 PII 泄露、AI 应用合规备案测试
Benchmark 实操、量化推理差异、评测集治理与测试数据合成
Agent 协议、实时音视频流、端侧小模型测试前沿
按课程阶段组织的 GitHub 仓库精选,覆盖入门、评测、RAG、Agent、Transformer、多端与前沿专项