即刻App年轻人的同好社区
下载
App内打开
阑夕ོ
357关注72k被关注36夸夸
知名IT人
😢这个人很懒,什么也没有留下。
阑夕ོ
16:35
在杭州东站偶遇即友@小马宋
42
阑夕ོ
15:15
中式拆弹挑战。
172
阑夕ོ
2天前
天下拿前司履历立人设者共一石,字节大概可以独得八斗,尤其在小红书上,晒字节工牌基本就是起号宣言了,大多数情况下,字节是不太想管的,也真的管不过来,只有在可能出问题连累自己的时候,会用发函手段遏制,但那也是私底下的沟通或者警告,登上抖音黑板报就是另一码事儿了。

抖音黑板报是字节在公共层面最高级别的对外发声渠道,属于哪怕故意想上都不见得能上的深海领域,专门指名道姓的点出一个具体的前员工,而具体的行为又不涉及到在职贪腐这种相对比较严重的性质,确实是很少见的。

以我对字节的揣度,最主要的问题可能是出在图上的那句话上,用字节给自己镀金,和踩字节给自己镀金,是完全不同的程度,尤其是在价值定性上构建一种不可知的叙事来拉踩抖音这种做法,完全是在摸电门,而自己又不是秦始皇,就很悲催了。
3736
阑夕ོ
2天前
很多人让我说说一下Anthropic今天发布报告里关于蒸馏指控的部分,行,我尽量讲真话。

蒸馏模型这个事情,分为事实判断和价值判断两个部分。

在事实判断部分,国产模型的态度,基本看不到明确否认的,这个很容易理解,因为它是真的会留下客观证据,从业者没必要为了一份工作,搭上自己一辈子的职业信誉。

主流的解释口径,在于价值判断,就是让教师模型言传身教这件事情本身,作为行业普遍的学习手段,是没问题的,所谓的禁止蒸馏,只不过是公司的用户协议,而无法上升到法律层面。

再说了,前沿模型在训练时,也一定从互联网上抓取了你我的生产内容,你我这样的人,有机会表示拒绝吗?表示了又能怎么样呢?

所以后来,Anthropic也在改变描述,在蒸馏前面加上了「工业级」这个定语,用以和正常合理的蒸馏行为作出区分,但总体上,仍然是用户协议的性质。

既然是用户协议,那就遵循猫鼠游戏的玩法,你可以封号,我也能起号,看谁手更快喽?

而且蒸馏并不是没有害处的,过于依赖蒸馏,就会锁死模型智能的上限,因为学生模型是不可能超过老师模型的,这是物理规律,所以在蒸馏之外,国产模型也在花大力气去做架构创新。

不过Anthropic的报告,倒是意外回答了关于今年7月短暂出现在OpenCode里的DeepSeek神秘灰测模型的都市传说,这个很有意思。

应该还有不少人记得,7月中旬,有人发现在OpenCode里调用DeepSeek的API完成任务时,会偶尔抽到一个能力明显超过V4 Preview的模型,前端效果足以媲美Fable 5。

你们现在去B站限定那段时间搜索,还能看到上百条录屏,全是各种炸裂体,坚信这就是DeepSeek憋的大招,发布出来即可成为中国第一个与Fable 5平起平坐的新模型,也就是大家期待的V4 Pro。

当时技术社区里有人质疑,因为实在和Claude的模型特征太像了,这是不是DeepSeek把一部分请求路由到了Claude完成,还被各种嘲讽:

「什么?你是说梁圣,收了V4 Preview的费率,给我用满血的Fable 5吗?义父!容我一拜!」

结果最简单的直觉反而是真的,因为8月DeepSeek-V4 Pro发布之后,并没有复现灰测模型的能力,甚至一个月不到就被自家的V4.1 Flash给斩杀了⋯⋯

虽然至今还有人对那几天的灰测模型念念不忘,认为这是梁圣在藏,有核弹级的好东西就是不拿出来给大伙用——所以才说已经成了都市传说——Anthropic的报告细节实际上交叉验证了这个说法,大部分蒸馏交互都是在7月份发生的。

这当然不是DeepSeek真的在做慈善,OpenCode是一个编程平台,用户交互的都是真实的高价值任务,在这个过程会产生长程Agent轨迹,非常适合抽取原本被隐藏的思维链,所以贴钱给用户发福利,是有确定回报的。

真正比较危险的,是在Anthropic明牌反华的立场下,还通过第三方中转站来做这样的蒸馏,敏感数据流向Anthropic之后,难保它不会反手交给美国情报部门。

而且中转站掺水也是无法控制的,晚点LatePost前段时间的一期播客就讲到了,有家国产模型在中转站可劲儿的蒸了好久,最后发现海外模型被节省成本的中转站偷偷替换成了自家的模型,相当于一直是在自己蒸自己⋯⋯

🤣🤣🤣
1617
阑夕ོ
2天前
无奖竞猜:哪家中国手机厂商会第一个把「Duo」用在新品型号里?
8610
阑夕ོ
3天前
即使中国的模型能力距离美国还有差距,但差得也不会太多,这意味着美国前沿实验室的研究源们看到的东西,最多几个月到半年后,中国的同行也能看到。

怎么就没有中国的研究员隔三差五的跳出来吓唬大家AI就要毁灭人类了呢?

因为这些中国人在学生时代是真做题啊,没有给老派科幻小说钻进自己脑子的机会,我指的不是「星际穿越」这种通俗意义上的流行作品,而是海因莱因、克拉克、亚当斯、阿西莫夫的那些反乌托邦寓言集。

「大西洋月刊」说美国AI行业活在一群13岁中学男孩的幻想里,他们要用一生去修复童年创伤,然后出现的过度补偿就是,把那些机器人摧毁世界、天网奴役人类的桥段,当成一种需要英雄站出来勇于对抗的自我使命。

成群结队的堂吉柯德。
4217
阑夕ོ
3天前
iPhone Duo的实机确实不错,手感非常好。
3712
阑夕ོ
3天前
买!!!
40
阑夕ོ
3天前
每天早上给你打分的Apple Watch⋯⋯什么做题圣体专用设备 老中狂喜🤩
21
阑夕ོ
4天前
统计了一下,我昨天提到的那个「发AI文章就自觉退出的群」,知乎是重灾区,20%以上的中标内容,都是出自知乎,确实迷惑性很强,可以说是集中了简中互联网最擅长去AI味的一批文豪。

比如今天中标的是下面这篇,群里有人还不信,表示你凭什么说这是AI,我说这样,你点开这个账号,看看这位大文豪的发言记录呗,他看了后不说话了。

当然我自己不是这个判断路径,直接从内容本身就能闻出那股味儿,但是就像我说过的,这个没有明确的方法论可言,就是熟能生巧的敏感度。

这一代AI文豪,如果翻账号历史的话,普遍都在2025年10月之前没有任何存在痕迹,不知道在哪里发财,以2025年10月为节点,他们在互联网上的表达欲突然高涨,笔耕不缀,文思泉涌,滔滔不绝。

为什么呢?

因为Anthropic在2025年10月发布了Agent Skill,非专业用户第一次获得了点对点的优化工具——而不再局限于提示词——去工程化的对文本进行「后训练」,由此拿到飞跃式的输出结果,和模型直出的文本品质形成巨大差距。

当然,说是非专业用户,但调试门槛还是有一些的,所以像是公众号这类「下沉」平台,流水线小编们还是没有被渗透到的,知乎因为用户规模更小,反而更能涌现出拥有一定程度文化水平的用户,去尝试AI文本的升级。
229