参数不再是瓶颈,标注才是:AI 竞赛的暗线转移
最近看到一篇研究,讲的是哥伦比亚航空法规的问答系统。他们用的是 Gemma1.1 2b。20 亿参数。不是 7000 亿,不是万亿级别,是那个在模型排行榜上连名字都不会出现的数字。 他们手里有 24,478 对专家标注的问答。每一对都经过航空法规领域的人验证。最终这个 2b 模型在特定任务上的表现,超过了不知道大多少倍的通用模型。 24,478。不是 2400 万,不是 24 亿。两万多个经过专家审核的问答对,加上一个不到 2G 内存就能跑的模型。 这个实验的结论比实验本身更有意思。它暗示了一个正在发生的范式转移,而大多数人还在参数竞赛的旧叙事里。 参数竞赛的天花板 […]