Gemini 3.5 Flash Lite 被测出批改作业不如 2.5 版
mazdarx2001 · reddit · 2026-07-24
一位用户称,Google 新版 Gemini 在批改课堂作业时,表现反而不如前代。
帖子指出,对比的是 Gemini-3.5-flash-lite 和 Gemini-2.5-flash-lite:尽管新模型可能有更新数据和更强推理,但在当天测试中,结果却更差。这个案例强调的是一个很现实的结论:新模型不一定在真实业务场景里更好用。
「模型」频道最新
- Unlimited-OCR 再登 Hugging Face 热门榜第一 — _akhaliq · 2026-07-24
- V4 更新可能延后,K3 权重或将在同一窗口发布 — teortaxesTex · 2026-07-24
- MacaronV1实测主打UI、Agent与2.1M长上下文 — 卡尔的AI沃茨 · 2026-07-24
- Kimi K3 Max 在软件任务上接近 GPT 5.6,价格仅 55% — togethercompute · 2026-07-24
- 开权重模型正在赢在“普通人买得起的硬件”上 — max_paperclips · 2026-07-24
- Fable 5 疑似接入 API 与 Slack 做工作流自动化 — beechinour · 2026-07-24