实测 DeepSeek 4.1 Flash 胜 Gemini Flash:更快更准还便宜得多
julianharris · x · 2026-09-19
作者在做软件规格文档的内容质量评估,深度测试两天后发现 @typesafeai 背后的小模型远达不到所需智能水平,无法胜任该任务。更新称:DeepSeek 4.1 Flash 目前比 Gemini Flash 更快、更准、且便宜得多。由于手上有一批 ground truth 数据,作者接下来打算微调一个小模型来替代。
所属事件:实测小模型评估软件规格不合格,DeepSeek Flash 反超(2 条相关)→
「模型」频道最新
- RL 训练分类模型 Laya 登上 Hugging Face 趋势榜 — convaiinnovations · 2026-09-19
- GPT-Live API 新增多款语音,开发者 Playground 可试听 — juberti · 2026-09-19
- 曝 DeepSeek v4.1 flash 论文图:上下文扩到 1M token 质量陡增 — andrew_n_carr · 2026-09-19
- 踩坑警告:OpenAI Agents API 空闲容器让用户被扣 1600 美元 — Wide-Arugula3042 · 2026-09-19
- 基准显示模型能认出图像模式却总选错补全图,卡在结构推理 — AndrewDai · 2026-09-19
- 用户提前 4 天耗尽 Codex 用量额度:重档也扛不住,称 Astra 很贵 — NYCounihan · 2026-09-19