即刻App
年轻人的同好社区
下载
App内打开
Alchian花生
10天前
Fable5.1确实是最强的,我觉得没啥问题,但是现在各种机构做图表表达差异的是否都太特么瞎做了,数学老师看了都沉默。
所以,我重新做了这张更真实的benchmark分数的对比图(图2)
两张图的数据完全相同,但读者从中能解读出的信息和判断会大有不同,我真觉得现在模型升级很好,但是对大多数人来说,模型升级本身对他能做的事,能做出的东西效果的影响已经没那么本质了。
32
1
1
来自圈子
AI探索站
118479人已经加入
加入