即刻App年轻人的同好社区
下载
App内打开
Alchian花生
10天前
Fable5.1确实是最强的,我觉得没啥问题,但是现在各种机构做图表表达差异的是否都太特么瞎做了,数学老师看了都沉默。

所以,我重新做了这张更真实的benchmark分数的对比图(图2)

两张图的数据完全相同,但读者从中能解读出的信息和判断会大有不同,我真觉得现在模型升级很好,但是对大多数人来说,模型升级本身对他能做的事,能做出的东西效果的影响已经没那么本质了。
11

来自圈子

圈子图片

AI探索站

118479人已经加入