最近突然一下冒出来很多看上去很像的所谓Personal Agent。
Instinct、Today、Rene、Muse、Town、Grok Bot。感觉很像年初 OpenClaw、Hermes 和各种 Agent framework 同时出现的那一波。一开始我也有点疑惑:这种号称“能长期运行、会调用工具、会操作电脑的 Agent”不是 chatgpt 和 claude 已经做得很好了吗?还有什么新花样?
这几天挨个注册试用,我觉得终于抓到了一个比较简单的分界:上一波 Agent 主要是 task-centric,这一波开始变成 person-centric。
前者的典型场景是:我脑子里已经有一件比较清晰的事情,然后寻找一个 Agent 把它做掉。
比如:
• 帮我研究一个主题
• 写一份报告
• 修改代码
• 打开网站完成某个操作
• 跑一个固定 workflow
任务本身是主角。Agent 接收 context,执行,然后结束。
而这些所谓的 Personal Agent 想解决的是另一类问题:
我甚至还没有形成一个明确的 task,只是有一个想法、目标、承诺,或者生活里某件以后还要继续处理的事情。
比如:
“最近想开始学德语。”
“以后这家公司有什么重要变化帮我关注一下。”
“下个月找个机会约一下某某。”
“我想认真研究一下 Personal Agent 这个方向。”
这些东西最大的问题并不是 AI 不会执行,而是根本没有一个天然的 “Done”。
这也是我看
@SUKIII 最近一条动态时很有共鸣的一点。她把 Personal Agent 带来的增量分成了两类:
一类是高委托成本的小事。
很多事情可能自己一分钟就做完,但要交给普通 Agent,就得先解释人是谁、邮箱是什么、日历在哪、背景是什么、最后想要什么。Agent 明明把 execution cost 降低了,但 delegation cost 还是很高。于是这些小事仍然“不值得委托”。如果 Personal Agent 已经长期知道我的联系人、关系、项目、日程、偏好,那么就一句:“下周约一下张三聊这个。”
另一类更有意思,是长期目标。
比如“学会一门语言”。普通 Agent 很擅长:“帮我制定一个三个月学习计划。” 然后它输出计划,任务完成。然后就没有然后了。“定计划”本身不是目的,但agent也只能完成并交付这个。而好的 Personal Agent 应该是:
今天测试一下水平 → 安排学习 → 看今天完成得怎么样 → 明天调整 → 最近旅游很忙就降低强度 → 两周后再拉回来……
也就是说,它负责的不是一个 task,而是一个持续存在的 objective。而更长期的目标甚至应该是,不再由我决定“下一步应该做什么”,而是Agent 基于长期知道我的目标和上下文,开始自主提出想法。这时候它才真的从“工具”慢慢变成“助理”。
一句话说,它是在替“一个任务”工作,还是在长期替“我这个人”工作?这个问题,可能就是今年前后两波 Agent 最清楚的一条分界线。