Theo 实测后仍留 Opus 当主力,Sol 6.1 只取代 Sonnet 做审稿
airesearch12 · x · 2026-10-04
被引用的推文澄清了 Theo 对 Sol 6.1 的完整评价:他的答案是「否」。视频结尾 Theo 表示 Sol 6.1 是个出色的 reviewer,可以取代 Sonnet 帮他审查代码,但「我本来真希望有模型能真正把 Opus 5.5 从日常主力位置上拉下来,但它没做到」。Opus 仍是他日常协作的主力模型,Sol 6.1 只负责审 Opus 的工作。
「模型」频道最新
- 实测者称 Claude Max 20x 体验已反超 GPT Pro,桌面端差距更明显 — mertdumenci · 2026-10-04
- Memento 论文将亮相 COLM,展示上下文管理学习进展 — DimitrisPapail · 2026-10-04
- 爆料称谷歌 Astra 6.1 蓄势待发,OpenAI 难以匹敌其前沿发布节奏 — teortaxesTex · 2026-10-04
- Aleph Alpha 新模型勉强超越 gpt-oss-120b,遭研究员调侃落后 13 个月 — davidad · 2026-10-04
- Linus 在播客中体验 Nous Hermes 本地部署并读对发音 — NousResearch · 2026-10-04
- AI 盛赞甘地,却会逮捕他吗?12 个模型历史决策实测 — Civil-Demand555 · 2026-10-04