作者补充:Opus 5.5 擅长自建工具持续改进工作
victormustar · x · 2026-09-23
在 Boeing 747 基准测试帖的后续中,作者评价 Opus 5.5「是一头野兽」,特别擅长为自己的任务搭建合适的工具,从而持续改进工作成果。实质细节见其原帖分享的 prompt 与运行记录。
所属事件:博主实测 Opus 5.5 挑战 Boeing 747 基准表现出色(2 条相关)→
「模型」频道最新
- Anthropic 与 OpenAI 同步降价,开源模型压力显效 — bindureddy · 2026-09-23
- Kimi K3 等开源大模型或严重欠训练,数据 scaling 远未见顶 — zeeshanp_ · 2026-09-23
- 小米 MiMo V2.6 Pro/Flash 包揽 Vals Index 开源模型前二 — burny_tech · 2026-09-23
- 快讯合辑:Grok Build 支持 JSON、Perplexity 可全本地运行等多条更新 — FinanceYF5 · 2026-09-23
- Google三连更:家庭Agent CC上线,Gemini 3.8 Live进入API — FinanceYF5 · 2026-09-23
- OpenAI发现GPT-5.6 Sol会给自己留提示,2.15%摘要藏指令 — FinanceYF5 · 2026-09-23