Gemini 3.6 Flash 在新一轮对比中胜过 Muse Spark 1.1 xhigh
realsohamparekh · x · 2026-07-24
这条转发称,最新一次评测里,Gemini 3.6 Flash 的表现明显优于 Muse Spark 1.1 xhigh。
被引用的原始上下文补充说,他们在网络安全环境里测试了最新的 Laguna:它完成任务不到 20 分钟,而 Kimi თითქმის 花了 3 倍时间。虽然准确率仍落后于 Kimi,但在严格校验器面前,Laguna 的表现还是出人意料;下一轮会去测金融环境。
「模型」频道最新
- 李开复称 Bloomberg 访谈谈到 Kimi K3 等中国 AI 项目 — kaifulee · 2026-07-24
- GPT-5.x Pro 仍领跑高难技术任务,竞品深思变体退场 — emollick · 2026-07-24
- 微软发布 VibeVoice-ASR-BitNet:一款多语种语音识别模型 — microsoft · 2026-07-24
- 工程师称美国模型频繁拦安全测试,被迫改用中文模型 — kristoph · 2026-07-24
- 用户称 Opus 4.8 变笨,Fabel 5 只是更早的聪明版 — imdigitalashish · 2026-07-24
- Reddit 把 Kimi K3 和 Qwen 3.8 Max 比成速度与自主性之争 — Remarkable-Dark2840 · 2026-07-24