Stanford CS329A 这门 Self-Improving AI Agents 公开课,把 test-time compute、verifier、工具调用、代码、记忆、多步规划和 agentic evaluation 放进了同一套课程里。
我感觉这比零散追框架名词更适合补体系。做 Agent 很容易只盯 demo 和工具名,但这门课一直在讲模型怎么从反馈、验证和失败轨迹里继续变好,这个视角挺值得看。
相关链接:https://cs329a.stanford.edu/
@aigc1024
 
 
Back to Top