听了 Ilya 的新采访,很多感触
2012 - 2020 是 Research 的时代
但是 2020 - 2025 是 Scaling 的时代
因为大家发现,只要不停扩大规模,就有更好的效果,这对公司来说是一个特别有确定性的投资,所以大家比拼的就是如何加数据、加算力,做更大规模的模型
但 Ilya 说,这条路差不多走到头了
Pre-train 模型越来越趋同
如果我们想要更强的智能,就需要 RL
而且是在不同的测试环境中的 RL
这就是他说的:different people come up with different RL training
产品公司自己拥有 RL 模型的时代,或许真的来了