即刻App年轻人的同好社区
下载
App内打开
LukeMyself
559关注851被关注0夸夸
Do it, dive in, have fun.
Developer | Bytedance | Baidu
美食、旅行、读书、摄影、带娃
LukeMyself
11天前
最近把 Matt Pocock Skills 融到开发里,效果很明显。

一边 /wayfinder /grill-with-docs 让需求澄清和文档化变得更简单,同时 /to-spec /to-ticket 也把技术文档和任务拆分变成了基础流程。Skill 内部还会调用其他相关的 Skill,比如 /implement 结束之后自动 /code-review,或者 /wayfinder 的同时发起 /grill-with-docs /research。

整个开发流程被几个 Skills 包装成功能和流程,实现标准化了。就像是团队里新来了一位 PMO,不仅熟悉流程,还定期把会议给约好了,确实提效。

这哥们儿不开发 UI 界面,但把最佳实践、方法论和 workflow 教给 Agent,其实也是在 build product。

AI Skills for Real Engineers

01
LukeMyself
11天前
AI coding 不是总要上最强模型或 high effort。大多数任务用次一级模型 + medium 执行,再用测试和 code review 兜底,反而更稳、更省。

这个道理不难想通,然而实际开发时还是忍不住想多一点思考、更强的模型总能少犯些错误、执行效果更好吧。

直到开发量上来了之后,Token 消耗速度和账单自然而然地治好我的“完美主义”倾向。😄
00
LukeMyself
14天前
OMG... 😮
X 上学到一招:在 Codex 中打开一个 Voice 会话,让它来给其他 Agent 安排任务。它会自己创建新会话,把任务安排下去,然后不定时汇报最新进展。
更难得的是,它会根据我的自然语言要求写成严谨的 Prompt,把任务安排得明明白白。

此时此刻我像极了一个小老板儿,旁边坐着一位高材生助理,帮我指挥一堆人干活。就算出门也可以通过手机远程指挥,颇有几分爽感😄。

唯一不确定的是,这么一个项目助理要额外耗费多少 Token——虽然是 Terra 模型,但毕竟它不做生产工作,只负责安排和协调。
就和开公司一样,多雇一个人就得多花一份钱(Token)。控制成本开支,就看你在多大程度上愿意亲力亲为了。
01
LukeMyself
25天前
OpenClaw 帮我写日记已经三个月了,迭代了几个版本,现在可以从闲聊中挖掘日记素材,追问、理解和共情,然后更新关于我的长期记忆。

每天自动同步到 Day One 的日记,已经越来越不需要我手动修改了。

于是,坚持了十几年的写日记习惯,现在变成了时不时和 AI 闲聊。

结果呢?我的日记从来没有写得这么丰富和深入,又这么轻松。这是 AI 改变我生活的一个典型例子。
00
LukeMyself
29天前
Codex 最近送 token 真的很大方。
每次周额度刚刚用完,第二天就自动重置了,连赠送的手动重置次数都还没机会用上。
难得有这么富有的感觉~ 多开几个分支同步跑着任务,咱有的是 token!😆
00
LukeMyself
1月前
原先下载美剧、电影导入 Apple TV 资料库时,我都愿意花些时间编辑基础信息、剧集标题、描述和封面,最终效果和 Apple TV 官方剧集类似。

现在这些繁琐工作都交给 Codex 了,创建一个 Skill 来批量操作,简直不要太方便。强迫症患者的福音。
30
LukeMyself
1月前
今天北京的晚霞超美⛅️
00
LukeMyself
2月前
拥有大量自由支配的时间,同时也有想做的事情和目标,感觉很美妙。
如果还能长期可持续的话,就更完美了。
00
LukeMyself
2月前
自从上手试着 vibe coding,每天都在感受到 AI 智力水平和主动性的跃进。最近一次开发过程就很有趣。

我用 /goal 指令给 Claude Code 下了任务:说清楚目标是什么,对齐了评测标准,批准了调优计划。然后我就放手了,让它自己跑。
AI 开始自己迭代,一轮一轮地优化,分数在往上爬。爬了几轮之后,它来找我了——
"效果已经有了明显提升,但还没达到你定的目标。目标会不会定得太高了?要不要先到这里,合入部署?"

我知道目标是可以实现的,于是自己去翻了最新的评测报告。翻完发现:效果确实提升得很明显。但有一部分评测打分和我预期的对不上——该得分的地方没得分,把总分拉低了。
问题不是效果不好,是标准没说清楚。
我跟 Agent 说:效果是好的,但这几处评测打分有偏差,该得分的没得分,我们再来对齐一下标准。
于是经过一轮标准的重新校准,Agent 再次迭代、再次评测——这次,很快就达到了最初定的目标。

然后,有意思的事情来了。
达到目标之后,Agent 开始自我反思:修改了评测标准才达到目标……这算不算作弊?
它先去问了自己的 Advisor。Advisor 的答复是:不算,因为效果确实变好了,标准本来就应该如此。
于是它尝试去关闭 /goal 任务,宣告完成。
结果被 harness 层拒了——因为评测标准被改过,原始目标在技术上没有被原样达成。
两边意见不一致,Agent 卡住了。
最后它又来找我,这次说得很直接:"你看,harness 层不认可目标完成了。但修改标准本来就是为了满足你的新需求,我不想改回去。要不你来拍个板,把这个 /goal 标记为完成,咱们继续合入吧?"
我拍了板。合入。

复盘这整个过程,我有种很强烈的感受:
这个 Agent 越来越像一个有独立思考能力的数字员工。它不是在等我一步一步地指挥,而是自己跑,遇到卡点停下来想一想,有自己的判断,然后在关键节点来找我对齐。
Vibe Coding 正在变成某种 Project Management。
你管的不是代码和每一行实现,而是 OKR、标准和协作节奏。Agent 是执行者,但它有主见,会推回来,会来找你商量——你更像是一个 PM,而不是一个程序员。
这个过程充满乐趣和惊喜。
01