博主实测 GLM 5.1 对阵 Gemini-3.8-flash 可视化能力
NickPassig · x · 2026-09-26
博主 NickPassig 在 LLM AI Arena 中对比测试 GLM 5.1 与 Gemini-3.8-flash 两个模型,测试项目为可视化算法(flocking 群体行为、图案生成等)。他总结称两个模型都很聪明,「而我是个笨蛋」。帖子未给出具体评测细节,但提及的模型型号值得留意(其中 Gemini-3.8-flash 可能是测试代号,未经官方证实)。
「模型」频道最新
- 文本分析显示 Claude Opus 5.5 句子短 17%,破折号减少 95% — arena · 2026-09-26
- 研究者称大模型已把 2×2 乘法「记熟」,一步算出无需中间步骤 — ctjlewis · 2026-09-26
- DL Weekly 第474期:GPT-6 Sol/Luna、AI Evals 指南与 RRSI 论文 — dl_weekly · 2026-09-26
- 爆料称 DeepSeek 用 NVIDIA 游戏卡跑小模型推理,异构算力成焦点 — teortaxesTex · 2026-09-26
- 智能价格每年暴跌 13 倍,博主预测明年笔记本可跑 Opus 级模型 — LeviTurk · 2026-09-26
- OpenAI 官方晒案例:Proaction 用 GPT-6 Astra 加速车队管理 Agent 开发 — OpenAIDevs · 2026-09-26