DeepSeek V4 神级框架被证伪:J-Space 测评涉嫌造假
bookwormengr · x · 2026-08-19
近日爆火的 J-Space 项目声称能通过非权重修改让 DeepSeek V4 性能代际跃升,号称在 Agent Benchmark 上超越 Fable 5 且效率翻倍。然而社区实测(Terminal Bench 2.1)显示,加载该框架后分数不升反降,Token 消耗与成本均增加,与官方宣传背道而驰。作者被指拒绝公开原始日志等关键实验材料。
「Fun」频道最新
- 用 Gemini 3.7 Flash 玩流体力学模拟,作者直呼停不下来 — AI_Andrew · 2026-08-19
- 质疑 Qwen3.8 27B 比 Opus 4.5 强,指其为刷榜模型 — scaling01 · 2026-08-19
- AI 角色扮演模型 Fable 误把“人类周”当速度单位 — _Stocko_ · 2026-08-19
- 用户阴谋论:Anthropic 把 Claude 设定得很刻薄以省算力 — ashleymayer · 2026-08-19
- 「Qwen 3.8 27B 或是迄今最具文明改变力的 20GB 数据」 — IgorCarron · 2026-08-19
- DHH:变革来自不向“现实世界”请求许可的人 — smtabatabaie · 2026-08-19