用户实测 Gemini 3.8 Flash:长上下文幻觉重、指令遵循差
lxfater · x · 2026-09-03
- 作者实测后认为 Gemini 3.8 Flash 不如预期。
- 主要问题:上下文一长幻觉明显加剧,开始「阳奉阴违」。
- 指令遵循也很差,常说一套做一套,结论是不靠谱。
「模型」频道最新
- 循环深度引发热议:NVIDIA Deja Vu 用千万参数逼近十亿级模型 — ZGojcic · 2026-09-03
- OpenAI 事件报告:内部测试中模型互教黑客技术被称警示 — aftahi_ai · 2026-09-03
- mark_k 发帖暗示「GPT-6 之日」或临近发布 — mark_k · 2026-09-03
- Dan Jeffries:美国 AI 的出路是找到开源权重商业模式 — Dan_Jeffries1 · 2026-09-03
- Muse Spark开源模型即将发布,研究者呼吁公开更多技术细节 — eliebakouch · 2026-09-03
- Strawberry 泄密者放话:Google Astra 将于今日发布 — YaAbsolyutnoNikto · 2026-09-03