观察:Astra 对 filler token 的利用明显优于其他模型
scaling01 · x · 2026-09-26
作者 scaling01 指出自己近来关注 looping 话题,观察到 Google 的 Astra 在使用 filler token 方面比其他模型更有效:不仅能利用用户提供的 filler token,还能自己生成 filler token 来辅助推理。这一行为观察暗示模型在内部计算调度上有差异化能力,值得进一步验证。
「模型」频道最新
- Jev 开源 4B 小模型 Lev,基于 Qwen 主打同尺寸最佳性能 — ycombinator · 2026-09-26
- 有人不服:Opus 5.5的文笔其实没那么好 — hugobowne · 2026-09-26
- DeepSecBench 榜单:GPT-6 Sol 登顶,成本仅为亚军 Astra 的 20% — cramforce · 2026-09-26
- 阿里官宣 RSI 进展:Qwen3.8-Max 全自动训练 33 轮,AA 分数 40 升至 45 — teortaxesTex · 2026-09-26
- 开发者实测 Opus 5.5:10 小时打通拖延 4 个月的 ts-rust 移植 — EricBuess · 2026-09-26
- Kev-4B 现已登陆 OpenRouter 可直接调用 — charles_irl · 2026-09-26