谷歌 Gemini 再次刷爆各大模型评测榜单
firstadopter · x · 2026-08-02
科技博主 firstadopter 指出,谷歌 Gemini 模型近期再次在各项基准测试中取得了极高分数(benchmaxxed),展现出霸榜级别的性能表现。
「模型」频道最新
- OpenAI API 内容审查被指比 ChatGPT 更严苛且易出错 — MParakhin · 2026-08-02
- DeepSeek V4 Flash 遭越狱:可生成勒索软件与毒品指南 — cyb3rops · 2026-08-02
- 14个开源模型复现Claude内部思考,最小仅270M参数 — austinc3301 · 2026-08-02
- Opus 3.5 性格大变?用户痛批模型同质化抹杀多样性 — liminal_bardo · 2026-08-02
- 推演:2027年iPhone或将跑通Claude 3 Opus级推理大模型 — appenz · 2026-08-02
- 跑通真实业务靠的不是跑分:速度与成本决定 Agent 生死 — RachelVT42 · 2026-08-02