只许输出 Simple Wikipedia 没见过的二元组,Gemma 4B 被逼出满屏错字
cephaloform · x · 2026-09-30
研究者 @erinbeess 对 Gemma 4B 做了一个受限推理实验:只允许模型输出能构成 Simple Wikipedia 语料中从未出现过的二元组(bigram)的 token。
结果模型输出了大量拼写错误——推测原因是维基百科语料里几乎没有错别字,模型只能「编造」语料中不存在的组合来满足约束,于是被迫产出大量生僻乃至拼错的词。这是一个展示语言模型对语料分布依赖的趣味实验。
「研究」频道最新
- 扩散模型原理教程入选 NeurIPS 2026,团队另中 7 篇论文 — mittu1204 · 2026-09-30
- UCL 发布 AMB3R-SLAM:消费级 GPU 实时重建公里级轨迹,误差降 70% — rsasaki0109 · 2026-09-30
- 提出 Prefix-Reuse FLOPs:任意上下文编辑让前缀缓存失效成本显形 — RulinShao · 2026-09-30
- 腾讯混元发布 ExplorationBench:用外星世界测 AI 探索能力 — TencentHunyuan · 2026-09-30
- 全开源机器人模型 MolmoAct 2 登顶 Reality Check 动态鲁棒性榜 — DJiafei · 2026-09-30
- CompVis 改进分布扩散模型,ImageNet 上 4 步采样达 4.48 FID — CompVis · 2026-09-30