开发者实测:Astra Max 做 Lean 定理证明,尚未见误报
mgostIH · x · 2026-10-07
开发者 mgostIH 表示,他在使用 Lean 形式化证明过程中见过各种 bug,但尚未遇到 Astra Max 把不成立的定理宣称为真的情况,侧面反映该模型在定理证明场景下的可靠性。
「模型」频道最新
- Perplexity 27B 决策模型 pplx-decider-v1 登上 Hugging Face 趋势榜 — perplexity-ai · 2026-10-07
- 温度设 0 也非确定输出:batch 形状与 kernel 归约顺序都影响 logits — JFPuget · 2026-10-07
- 付费用户炮轰 OpenAI:少搞重置,多回应客户、把模型做好 — AirportEither2456 · 2026-10-07
- 实测:GPT-6-luna 用 API 每 effort 档能多给推理 token — LysandreJik · 2026-10-07
- Bug Hunt 实测:GPT-6.1 Sol 能翻盘修复, Muse 系仍是最便宜主力 — PawelHuryn · 2026-10-07
- 博主自烧订阅算出倍率:SuperGrok 80x、Muse Power 137x 用量杠杆 — PawelHuryn · 2026-10-07