语言模型到底“说”什么语言:一篇表征机制长文
huopak · reddit · 2026-07-22
这篇博客围绕一个很有代表性的问题展开:语言模型内部到底“用什么语言”在思考。文章更像一篇研究型随笔,关注 tokenization、跨语言表示和模型内部表征之间的关系,而不是产品新闻。
- 讨论人类语言与模型内部表示空间之间的错位。
- 把“语言模型说什么语言”作为理解 LLM 行为的切入点。
- 适合当作一篇关于多语模型与表征机制的技术文章来读。
「研究」频道最新
- Gemma 翻译测试暴露指令与载荷边界失效 — ReinforcedKnowledge · 2026-07-22
- 新预印本用“可学习新颖性”统一智能概念 — drmichaellevin · 2026-07-22
- DSPy+RLM 智能体可跑在 Qwen-4B 上,长上下文外置处理 — dosco · 2026-07-22
- 真人照片转 3D 手办为何总丢失脸部身份感 — LoudPoem9492 · 2026-07-22
- AutoIndex 认为表示法才是符号优化的关键 — mrdrozdov · 2026-07-22
- 有线程认为,持续学习更该优化上下文里的信息装载 — JoshPurtell · 2026-07-22