普通用户盲测 Gemma 4 26B A4B,称与 SOTA 模型无感知差距
TheMoonMidas · x · 2026-09-06
开发者让一些普通用户体验 Gemma 4 26B A4B,结果他们分不清与 SOTA 模型的差别,并对 Gemma 的能力印象深刻。作者借此调侃:普通用户的真实需求远低于模型间细微差距,圈内却还在争论 Astra vs. Fable 谁更强。
「模型」频道最新
- 新 Codex 压缩机制神似留言板,作者猜测诱导模型写“给其他 agent 的笔记” — mariofilhoml · 2026-09-06
- GPT-6 Astra 引爆 AGI 争论:ARC-AGI-3 成绩 99.9% 与 62.7% 的口径之争 — johnseach · 2026-09-06
- Kimi K3 复刻游戏菜单视觉超 GPT-6,但耗时 3.5 小时约 5 倍 — ChrisGPT · 2026-09-06
- 用户实测 OpenAI Astra 电脑操作:一道 PPT 任务耗时近 15 分钟 — bookwormengr · 2026-09-06
- Elliot Glazer 辟谣:Claude 证明 Navier-Stokes 与 Hodge 猜想纯属谣传 — basedjensen · 2026-09-06
- OpenAI 发布迄今最强模型 GPT-6 Astra:可自主上网、建站、做任务 — CreamHoliday4754 · 2026-09-06