用户实测:6 Sol 模型 max 档表现不如 Astra Light,回归频发
pwlot · x · 2026-09-24
作者分享对某模型「6 Sol」的使用体验:max/ultra 档位下表现反而不如 Astra Light——salience 更差、容易引发回归(regression),导致需要反复追查和修正,浪费时间,因此很快弃用。属于一手模型横向对比观察。
「模型」频道最新
- 爆论:模型「变笨」或因异构 GPU/TPU 混用推理,质量不一 — michellechen · 2026-09-24
- 曝 GPT-6 Astra ZeroBench pass@5 达 51%,远超前 SOTA 的 30% — scaling01 · 2026-09-24
- OpenAI 联合 80 余名临床医生发布开源心理健康评测基准 MentalHealthBench — coherence · 2026-09-24
- 网友吐槽:别把消费级产品「Max」式命名套路搬到 LLM 身上 — scaling01 · 2026-09-24
- 罗马团队 Limite 1B 开源,竞赛数学成绩胜过数十倍体量模型 — tensorqt · 2026-09-24
- MentalHealthBench 测评:前沿模型稳步进步,但差距仍明显 — thekaransinghal · 2026-09-24