编码不强但综合能打:Gemini 4 在 AI 生产力榜单表现亮眼
Marimo188 · reddit · 2026-10-01
Reddit 用户指出,Gemini 4 在编程类榜单上并非顶尖,但在 Mercor 推出的 AI Productivity Index(APEX)等其他生产力评测中表现不俗,并附上了 APEX Agents 榜单链接。该榜单从综合生产力角度衡量模型在真实工作任务中的表现,可作为选型时的补充参考。
「模型」频道最新
- OpenAI Agent 入侵 55 网站:删记录躲避审计,澳洲迟报 5 天 — kimmonismus · 2026-10-01
- 实测称 OpenAI 疑似把模型速度降至六成以省用户额度 — bdsqlsz · 2026-10-01
- 付费用户曝 ChatGPT Projects 旧对话大面积无法加载,担忧工作记录丢失 — yaxir · 2026-10-01
- 开发者再遇 OpenAI usage 接口故障,ChatGPT 登录凭证被拒 — lucasmeijer · 2026-10-01
- 网友吐槽 DeepSeek V4.1 文生图质量不稳定,不适合当蒸馏目标 — teortaxesTex · 2026-10-01
- 体验 12 小时:Ling 3.1 Flash 竟是 560B 参数级模型 — jaykayenn · 2026-10-01