即刻App年轻人的同好社区
下载
App内打开
谈小罗coding
141关注290被关注1夸夸
程序猿 | 出海新人
Android | Flutter | ArkTS | TS
Explore Web3 | 海外工具站
谈小罗coding
3天前
是应该说这个 xxxx-flash 模型聪明呢?还是实在呢?
10
谈小罗coding
1月前
花了 1 亿 Token 用 dsh 做了 dsh 插件导航

DeepSeekHarness 昨晚上公测,趁着 API 还没有涨价,

用 DSH 做了一个 deepSeekharnessplugins.com 的网站,审美也是满在线的

便宜是真便宜,用了接近 1 亿 Token,花费 5 块多一点,全程 V4Pro Max,出了中间因为 API 超时断了几次,都挺好的

缓存率是真的高,图上显示是 100%,我估计应该是 99.99% 这种被四舍五入了。

插件系统初看有些复杂,但这也说明为啥叫 harness ,而不是叫另一个 code
30
谈小罗coding
1月前
今天回头看眼之前的基金收益,感觉还得是大道至简,越简单的策略带来的收益至少能超过平均线(现在已空仓)

​有多简单呢?

1. 选中沪深 300,中证 500,债券基金,纳斯达克 100,标普 500
2. 设置每周/月一次定投
3. 设置一年一次再平衡日程提醒
4. 保证你余额宝有钱就行了

​任它云卷云飞,努力在场外挣钱,静待花开
00
谈小罗coding
2月前
最近睡前在用豆包和小米粒讲绘本,让我想起了 GPT 刚刚出来那段时间,我们做的两个功能:

1. 古早的语音助手:它是基于关键词匹配的。可以用它跟小朋友一起讲讲笑话、讲讲指定的绘本,或者讲讲今天天气怎么样之类的事情。
2. 摄像头拍绘本:用摄像头拍绘本,如果那个绘本在我的知识库里面有,我就会匹配一段绘本的语音去讲这个绘本。

这才过去不到三年,这两个功能基本上完全被 AI 替代了。甚至都不用专门去做一个应用,一些通用的大模型应用就已经能做得 60 分了。

00
谈小罗coding
2月前
5 月时候一个月蹬了 17 亿,感觉自己蹬得好猛

​没想到两个月过去,一天都蹬了 35 亿。

​为啥蹬这么猛,得益于两个方面
一是模型的的长程任务、Agent 能力的增强
​二是工具的 harness 能力的增强

​昨天大概就是 7-8 个项目并行在跑,然后他们又派发了不少的子 agent 在干活
60
谈小罗coding
3月前
蹬了一下午 @王登科 大佬做得 Agent Tank,挺有意思的,排行榜上的王者 Tank 们真猛,完全打不赢

5 万奖金的 Agent 坦克大赛,早上现造的坦克,下班前赢了 Claude 和 Kimi 各一场

01
谈小罗coding
4月前
之前公司的龙虾用的顶级模型 opus sonnet,但账单很吓人,比人还贵

于是开启了用国产模型降本之路,基本热度很高的模型,我们都做了尝试。

基于我最常用的一个查日志的链路,我来讲下我的体感。

背景:
1. 龙虾里面有很多的 skill
2. 我的查日志的链路做了一个 skill A,但是公共的一个 skill B有些冲突,所以我单独放了一个路径,并在 TOOLS.md 里面做了引用说明

表现:
qwen-3.7-max:看了日志格式,找到了 skill B,结果放进去跑不通,开始想办法,发现了这个日志在阿里云,去下载结果没有找到密钥,最后寻求我的帮助

deepseek-v4pro:不止匹配到了 skill B,甚至还找到了 BCD,但发现都不能解析这个日志,最后说查了记忆,也不知道是怎么解析,需要我提供进一步信息

glm-5.1:实际上它也找到了 skill B 去,然后发现不对,就自行查记忆去了,然后找到了 skill A,就能正确的走后面的流程了,更让人惊喜的是,在经历几次之后,glm-5.1 模型下的龙虾就记住这个事儿,直接去找了 skill A

综上,我的体感是 glm-5.1 最好,怪不得老外也来抢智谱的 coding plan
21
谈小罗coding
4月前
上个月花了 17 亿 token ,但并没有让我更轻松,反而更累了

有了 AI 后,多线程处理事情的场景变得多了起来了,人类上下文的切换,关键决策的制定都让人感觉疲惫

虽然可以 harness AI 自动跑起来,但缺少人类的决策,始终觉得差了一些灵魂。
00