Zvi:若新模型是刷榜产物,AI 圈几天内就会识破
TheZvi · x · 2026-09-04
回应关于某传闻新模型是否「jagged benchmaxxing」(刷榜但能力参差)的讨论。Zvi 表示 AI 圈的人不傻,如果该模型真是靠刷榜堆出来的表面成绩,社区几天内就会发现其真实能力的不均衡。这是围绕新模型真实能力的第一波圈内判断。
所属事件:传闻新模型引热议:Zvi与Marcus讨论刷榜与真实能力(2 条相关)→
「模型」频道最新
- 曝 GPT-6 Astra 测评中满分通过 ExploitBench 并发现两个零日漏洞 — VraserX · 2026-09-04
- 新模型发布遭质疑:KOL 齐赞 vs 付费用户根本拿不到访问权 — xeophon · 2026-09-04
- 团队微调 Gemma 12B 做音频校对推理,对标 Gemini 成绩 — ojasvi_yadav · 2026-09-04
- Astra 首批上手印象:写作口吻干净、几乎无术语腔 — soumitrashukla9 · 2026-09-04
- 纳德拉称 Astra 已有 Azure 早期客户,Altman 回应很兴奋 — i_dg23 · 2026-09-04
- 阿布扎比研究机构 IFM 一次放出 6 个全开源 AI 模型 — Polymarket · 2026-09-04