即刻App
年轻人的同好社区
下载
App内打开
超级峰
10天前
Stanford CS329A 这门 Self-Improving AI Agents 公开课,把 test-time compute、verifier、工具调用、代码、记忆、多步规划和 agentic evaluation 放进了同一套课程里。
我感觉这比零散追框架名词更适合补体系。做 Agent 很容易只盯 demo 和工具名,但这门课一直在讲模型怎么从反馈、验证和失败轨迹里继续变好,这个视角挺值得看。
相关链接:
cs329a.stanford.edu
21
4
7
来自圈子
AI探索站
117476人已经加入
加入