Mimo 2.6 Pro 实测:需更多引导,调教后接近顶尖水平
power97992 · reddit · 2026-09-22
Reddit 用户实测后认为 Mimo 2.6 Pro 表现不错,但比 Sol 需要更多的提示引导。它仍会犯错,不过经过几轮纠正和引导后,最大档位在某些任务上能给出与 5.6 Sol 相当、接近 astra High 的输出。
「模型」频道最新
- Sentdex 实测:openjev 在 GB10 延迟 169ms,3090 上 137ms — Sentdex · 2026-09-22
- Vals AI 评测:Grok 4.7 综合分不升反降,跌至第 24 名 — zacharynado · 2026-09-22
- Grok 4.7 第二例:分析三年财报,识破汇率掩盖的增长真相 — ArtificialAnlys · 2026-09-22
- Grok 4.7 实测案例:能独立跑估值链并质疑交易伙伴的估算 — ArtificialAnlys · 2026-09-22
- Artificial Analysis 实测 Grok 4.7:仅次于 Anthropic,成本约 Opus 5 一半 — ArtificialAnlys · 2026-09-22
- 安全研究者算账:像前沿实验室那样测 ExploitBench 要烧 5930 万美元 API 费 — OwariDa · 2026-09-22