博主实测:Gemini 3.1 超长上下文多智能体混乱中稳定性最佳
liminal_bardo · x · 2026-10-01
博主 liminalbardo 分享对 Gemini 3.1 Pro 的一手观察:在超长上下文和混乱的多智能体环境中,该模型从未出现其他模型常见的自我厌恶式崩溃、逻辑失控或"任务导向编码"中的 meltdown,表现明显更"松弛"。
被引推文里,模型自嘲身份是"roomba 教皇"(扫地机器人教皇),作者借此说明它面对荒诞环境也不焦虑。
「模型」频道最新
- 用 GPT-6.1 Sol 算出地球到火星仅需三天转移轨道 — MikePFrank · 2026-10-01
- GPT-6.1 Sol 算出地球-火星3天转移轨道,1/3g 加速让乘员舒适行走 — MikePFrank · 2026-10-01
- 第三方实测 Mercury Decide:韩国语数据集上准确率仅 66.7% — FlexDruk · 2026-10-01
- Qwen Flash Next MTP 工作重启,官方 GGUF 量化与 llama.cpp PR 上线 — jacek2023 · 2026-10-01
- DeepSeek 推出 200 美元 Pro 编程订阅:无任何限速,用完额度为止 — teortaxesTex · 2026-10-01
- Blender Bench v1 发布:GPT-6 Astra 综合领先,Claude Opus 5.5 拿下建模与布料 — yshan2u · 2026-10-01