彭博曝 Gemini 4 跑分亮眼但员工实测不佳,编码任务吃力

kimmonismus · x · 2026-10-01

据彭博社报道,有内部人士透露 Gemini 4 在常用基准测试上表现优异,但员工在实际工作中使用时表现不如预期——该模型在某些编码任务上明显吃力。KOL kimmonismus 转述并感叹「希望这些传闻不是真的」,引发对 Google 新模型跑分与实战落差的热议。

所属事件:彭博曝 Gemini 4 跑分亮眼但内部实测编码掉队(18 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →