为何 tokenizers 仍难被端到端优化

seanmcdonaldxyz · x · 2026-07-29

Paul Cal 认为,文本 token 表示之所以还没有被“极致优化”,根本原因是 预训练太慢、太贵:前沿模型训练机会很少,而一个 tokenizer 好不好,往往要到大规模使用后才看得出来。

他给出的关键理由包括:

这条更像对 tokenizer 设计瓶颈的一次系统性解释,而不是单点结论。

所属事件:预训练成本高昂致使tokenizer难以彻底优化(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →