PostTrainBench v1.2 出新结果,后训练能力榜更新
mariofilhoml · x · 2026-10-02
mariofilhoml 分享了 PostTrainBench v1.2 的最新评测结果,并称结果「有意思」。具体榜单细节在链接中,本条为引子性短帖。
「模型」频道最新
- Varun Neal:文本扩散模型将成为 LLM 推理的未来 — akbirthko · 2026-10-02
- Gemini 4 未发布先遭群嘲,TPU 算力优势被低估 — haider1 · 2026-10-02
- 设计师实测:Opus 5.5 设计任务大幅领先 Astra,Sonnet 5.5 快且省额度 — tomjohndesign · 2026-10-02
- Polymarket 开盘:OpenAI 年底前全面暂停 AI 训练概率仅 10% — Polymarket · 2026-10-02
- macOS 升级后半夜自动唤醒?元凶是 Apple Intelligence 的夜间任务 — DanielLockyer · 2026-10-02
- EMNLP 论文:显式推理反而拖累重排器,关掉推理更准 — lintool · 2026-10-02