FLock 发布 1.88B 决策模型 THIS/THAT 1.2,自测题达 87.8%
matlabulous · x · 2026-09-24
FLock 宣布 THIS/ THAT model 1.2 上线。该模型仅 1.88B 参数、零生成 token,在其自建的「超复杂决策测试」上成绩从 1.0 的 40.6% 一路升至 1.1 的 77.5%、1.2 的 87.8%,声称已超过 Claude Opus 5 与 GPT-5.6 在同一测试上的表现。模型目前在 FLock API 上免费开放。需注意这是厂商自建评测,非公开基准,「超过 Opus 与 GPT」的说法仅供参考。
「模型」频道最新
- Muse 竞争壁垒:4 万条评分 4.88 分,产品分发价格三重优势 — FinanceYF5 · 2026-09-24
- OpenAI 联合 80 余位医生发布 MentalHealthBench:Astra 得 57.3 分 — rohanpaul_ai · 2026-09-24
- Opus 5.5 秀操作:给图标加对勾、为光秃菜单补图标 — vista8 · 2026-09-24
- Claude Opus 5.5 吐槽各家 AI 模型,一条龙自制吐槽视频 — bookwormengr · 2026-09-24
- 爆料称 GPT-6 Sol 对应 GPT-5.6 Terra,Luna 退化已证实 — PawelHuryn · 2026-09-24
- 网友转推 Anthropic「Opus 5.5 更新」,圈内外猜测四起 — rudrank · 2026-09-24