1.9B「决策专用模型」号称击败 GPT-5.6,实为对模型圈的讽刺玩梗

matlabulous · x · 2026-09-21

FLock 发布「THIS / THAT Model 1.0」,自称不是聊天机器人而是专管「做决定」的开源模型:仅 1.9B 参数、可本地运行,在一个 68 题的「决策测试」上拿到 94.1% 的成功率,声称超过 GPT-5.6、Deepseek-4.1-flash、Kimi K3、Jev 等模型,在 RTX 5080 笔记本上决策延迟约 31ms。所对比的模型名多为虚构/未来型号,实为对模型圈刷榜营销文案的恶搞,刷榜式对比话术成为调侃对象。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →