逆向工程 Claude 分词器:Anthropic 未迷信缩放
stanfordnlp · x · 2026-08-01
斯坦福 NLP 团队转发了一项关于 Claude 分词器的深度逆向分析。原作者成功进一步破解了 Claude 的分词机制并撰写了详细报告。
斯坦福教授 Chris Potts 评价该分析揭示了一个有趣的现象:Anthropic 团队似乎并没有像部分信徒那样对“The Bitter Lesson”(算力至上/简单扩展)盲目崇拜,暗示其在模型架构(如分词处理)上投入了非缩放主义的定制化巧思。
「研究」频道最新
- 学者视AI数学证明如显微镜:呼吁开源复现与严谨报告 — rbhar90 · 2026-08-01
- TriFlow:利用流匹配生成艺术家级 3D 网格拓扑 — rsasaki0109 · 2026-08-01
- 开源 Python 库 GeoAI:将深度学习引入地理空间数据分析 — tom_doerr · 2026-08-01
- AI挑战千禧年大奖难题未果,但测试期算力仍有挖掘空间 — polynoamial · 2026-08-01
- Google 测 180 种配置:多智能体并行提升性能,串行反而变差 — bibryam · 2026-08-01
- AI验证10项科研突破:生成证明成本不足2000美元 — __nmca__ · 2026-08-01