1.9B「决策专用模型」号称击败 GPT-5.6,实为对模型圈的讽刺玩梗
matlabulous · x · 2026-09-21
FLock 发布「THIS / THAT Model 1.0」,自称不是聊天机器人而是专管「做决定」的开源模型:仅 1.9B 参数、可本地运行,在一个 68 题的「决策测试」上拿到 94.1% 的成功率,声称超过 GPT-5.6、Deepseek-4.1-flash、Kimi K3、Jev 等模型,在 RTX 5080 笔记本上决策延迟约 31ms。所对比的模型名多为虚构/未来型号,实为对模型圈刷榜营销文案的恶搞,刷榜式对比话术成为调侃对象。
「Fun」频道最新
- Modal 联手 Gray Area 推出 AI 艺术展:13 件委托作品本月亮相旧金山 — charles_irl · 2026-09-21
- 「Claude 一年产出等于赞比亚全年 GDP」,对比引出 AI 与落后经济的反差讨论 — weskambale · 2026-09-21
- EA 圈爆论循环:先冒犯再喊冤,回应者反被骂不体面 — mjdramstead · 2026-09-21
- AI 版权争论:csuwildcat 称受害者无需关心赔偿黑箱 — csuwildcat · 2026-09-21
- AIGC 佬首试 CG 风格:2D 漫画打击感结合 3D 画面 — huangyun_122 · 2026-09-21
- 论文推广新打法:推文当摘要,博客当扩展版 — willcb · 2026-09-21