Skip to content

普通人出身,就像一个在低质量、高噪声数据上过拟合出来的模型。

见识有限,反馈粗糙,环境又持续奖励短期收益。久而久之,人会主动剪掉那些暂时无用、回报缓慢的东西,越来越擅长应付眼前,也越来越难理解长期。

很多认知局限,源头就在训练数据太差、奖励函数太短。

破局的方法很简单:蒸馏更好的模型。

多读真正好的书,多听专业的人完整讲一件事,多和 SOTA 级 AI 深聊;少看八卦,少泡在碎片信息里,少让情绪替你筛选世界。

你无法选择自己的预训练数据,但可以决定用什么后训练自己。

一个人最终会变成什么样,很大程度上取决于他长期、反复地把什么喂给自己。

Cherry Chu · Projects, notes, and working documentation.