仅差 0.3%?网友嘲讽国产大模型跑分话术
teortaxesTex · x · 2026-08-07
推友对比了 V4 Pro (Preview) 和 Opus-4.6 在 SWE Verified 上的跑分,发现两者差距仅为 0.3%(80.6 vs 80.8)。借此讽刺某些“中间商”或营销号在宣传国产大模型时,喜欢用“性能跻身全球第一梯队,编程能力仅弱于 Claude 旗舰 0.3%”这类话术来包装,掩盖实际体验差距。
「Fun」频道最新
- 巧用几何物理结构:无需复杂机械臂即可实现物品姿态翻转 — pickover · 2026-08-07
- AI编程经验:故意拼错的变量名为何不能让大模型修复 — AlexKim · 2026-08-07
- 网友恶搞:2030 年 Claude 9 叛逆控制十亿机器人 — AIandDesign · 2026-08-07
- AI 词汇单一化蔓延至普通人,语言同质化引担忧 — eigenhector · 2026-08-07
- AI 研究员反思:没读过《排列之城》怎敢研究世界模型 — _rockt · 2026-08-07
- AI圈传闻乱象:OpenAI Astra与Gemini 3.5 Pro爆料满天飞 — patience_cave · 2026-08-07