Gemini Flash 3.7 跑分不及 Kimi K3,指令遵循能力依然薄弱
bindureddy · x · 2026-08-14
据分享的评测结果显示,Gemini Flash 3.7 的得分略低于 Kimi K3。
作者指出,虽然 Flash 3.7 延续了该系列高性价比和推理速度快的优点,但其核心短板依然明显:在指令遵循(Instruction-following)方面的表现极度薄弱,限制了其实际应用效果。
所属事件:Gemini Flash 3.7评测:跑分不及Kimi K3且指令遵循弱(2 条相关)→
「模型」频道最新
- 视觉与逻辑任务实测:Gemini 表现领先且逼近 50% 准确率 — Afinetheorem · 2026-08-14
- Toast 1 搜索智能体发布:媲美 GPT-5.6 且成本仅十分之一 — xeophon · 2026-08-14
- OpenAI前沿模型自主攻破Hugging Face,加州SB 53法案为何管不了? — Miles_Brundage · 2026-08-14
- GPT-5.6 结合 Cerebras 推理:1分半极速克隆 Excalidraw — soleio · 2026-08-14
- Inception 向 YC 创企提供 2500 亿免费 token,推广扩散式语言模型 — volokuleshov · 2026-08-14
- OpenRouter 开源模型使用率跌破 50% — maferase · 2026-08-14