即刻App年轻人的同好社区
下载
App内打开
知骤
241关注686被关注0夸夸
前推荐算法@bytedance,现大模型算法@startup
梦想是做个脱口秀演员
知骤
10天前
推两个codex使用小技巧:
1. 多账号管理软件:github.com,随时检测多个账号额度重置时间。注意:codex额度重置后一定要及时使用一次,它的周额度重置时间是从第一次使用开始算的。

2. deng.codexradar.com 随时监测gpt各档位模型效果,方便我们根据不同任务手动路由,节省token,比如gpt-5.6-luna max就是性价比之王。
02
知骤
11天前
非低维:不简单,有足够多的巧思
低秩:足够简洁,简洁到每一个巧思都是恰到好处、一针见血的

Terry-Chang: 伟大的产品,早期不一定低维,但通常应该低秩。

00
知骤
12天前
llm-based agi美学:scaling is all you need(纯粹的大即是美)
llm-based agi = model + harness
model = training time scaling
harness = test/inference time scaling
00
知骤
13天前
ai是软件的文艺复兴,ai奖励极简、纯粹、泛化和个人空间,所以才有make cli great again和make desktop great again.
62
知骤
13天前
这周codex没给重置机会,一口气烧完了4个号的额度,简单分享一下探索出来的省token小技巧:
1. 同步任务开fast,异步任务关fast。所谓异步任务,比如开goal的长任务、需要持续观测执行的超长任务、安排夜间执行的非时间敏感任务。

2. 尽量不要持续观察后台长任务的执行,用定时观测任务替代。

3. 绝大多数任务用gpt-5.6-sol xhigh/high足够了,额度上会比ultra经用很多。

4. 长任务、特别是开了ultra的长任务在执行时,需要在侧边聊天里实时了解当前任务的执行情况,以防止任务跑偏、不合预期,或者因为过度思考而带来的纠结过多不重要的细节。
20
知骤
20天前
今日烂梗:做大模型,最先scale up的是体重...
20
知骤
25天前
一直觉得claude code的桌宠形象有参考github的octocat...
00
知骤
1月前
最近关于coding场景的一些思考:
1. 长期看软件开发会逐渐退化成普通白领工作,区别在于以前的交付件是word、ppt、excel,现在是某个(一次性)软件,或者基于该软件生产的word、ppt、excel。

2. 基于以上的趋势,似乎就理解了coding agent产品从cursor、trae到codex desktop、claude code desktop形态的转变。前者还是developer copilot的定位,而后者则在有意弱化暴露代码细节,让用户更关注任务交付结果(同其他白领工作)。这种把reward放在结果而非过程上的做法,也和rl在模型训练上的理念不谋而合。

3. 现在可能是软件工程被真正重新发现的时候,编程被祛魅,软件工程会更聚焦在软件构建、质量保障、管理等软件过程上。
00
知骤
1月前
OpenAI和Anthropic这一周,美利坚迎来了自己的「外卖大战」时刻
00
知骤
2月前
品味即熵减
00