十场成体系的深度分享,把 AI 智能体从「原理」讲到「评测」、从「单体」讲到「群体」、从「用起来」讲到「自己进化」。
不是又一份 API 调用教程,而是一线视角下的系统拆解。
- 成体系 —— 10 个主题串成一条从入门到前沿的完整路径,而不是零散的 PPT 堆叠。
- 有观点 —— 每一场都带一线经验与真实踩坑,而非照搬官方文档。例如《智能体评测》融入了 Anthropic Demystifying evals、姚顺雨 The Second Half、Hamel Husain 等一线视角。
- 重落地 —— 工程实践、评测、多智能体编排都指向一个问题:它到底能不能真的跑起来。
- 跟得上 —— 内容覆盖到 2026 年的前沿范式、开放问题与趋势判断。
建议按顺序看;也可以直接跳到你关心的主题。点击标题即可打开对应幻灯片。
| 主题 | 一句话 | 程度 |
|---|---|---|
| [智能体技术介绍 · 基础与原理] | 什么是 Agent、感知—决策—行动循环、规划 / 记忆 / 工具、ReAct 等核心心智模型 | 入门 |
| [智能体技术介绍 · 前沿与落地] | 最新范式 + 真实落地路径,从能演示的 Demo 到能上线的系统 | 入门 |
| 主题 | 一句话 | 程度 |
|---|---|---|
| [智能体 RAG] | 让 Agent 学会「查资料」:检索增强与 Agentic RAG 的模式与取舍 | 进阶 |
| [智能体强化学习] | 用 RL 训练与对齐 Agent 的思路、奖励设计与常见坑 | 进阶 |
| [智能体工程实践] | 脚手架、可观测、成本、可靠性 —— 把 Agent 做「稳」的工程功课 | 进阶 |
| [智能体评测] | 三类裁判、pass@k vs pass^k、11 个踩坑;为什么评测正在取代训练成为瓶颈 | 进阶 |
| 主题 | 一句话 | 程度 |
|---|---|---|
| [多智能体系统] | 多个 Agent 的编排、协作与分工,以及它带来的新失败模式 | 深入 |
| [进化式编码智能体] | 让代码在评测反馈中自我迭代 —— 进化式方法用于编码智能体 | 深入 |
| [智能体自进化] | 自我改进闭环:Agent 如何做到「越用越强」 | 深入 |
| [Hermes 与 OpenClaw] | 两个具体系统的实战拆解与对照 | 深入 |
- 想系统入门 AI Agent、不满足于零散博客的工程师与学生
- 正在把 Agent 往生产环境落地、需要方法论和避坑清单的团队
- 要做内部分享 / 讲座 / 培训、想要一套现成高质量材料的人
- 关注 Agent 评测、多智能体、自进化等前沿方向的研究者