Base-10 研究员:Kimi 与 GLM「几乎客观上」强于 Opus 5
nomorebuttsplz · reddit · 2026-09-15
Reddit 用户推荐 Dwarkesh 播客新的一期,嘉宾是 Base-10 的 Charlie O'Neill,核心论点是 Kimi 和 GLM「几乎客观上」比 Opus 5 更强。
推荐者指出:一向对 AGI 进展持怀疑态度的 Dwarkesh 近几个月也被证据说服,认为我们正走在通往 AGI 乃至 RSI(递归自我改进)的路上。这期节目破除了「因数据不足而碰壁」的迷思——一年前以为撞墙,实际上仍有大量低垂果实,嘉宾解释了原因并将趋势外推到未来。发帖人还吐槽:这个 sub 现在反而变成怀疑 AI 进步的地方,「外交辞令地说」,是信息不足加上泡 Reddit 太久。
「模型」频道最新
- Claude Code 五折周用量推广结束,实际用量缩水 17% — msg · 2026-09-15
- DeepSeek-V4.1-Flash 登 Agent Arena 第三,单任务成本仅 0.07 美元 — arena · 2026-09-15
- 研究员称 RL 评估门槛已提高:reward hacking 太多,标准收紧 — tszzl · 2026-09-15
- Claude 3 Opus 将另一模型 Mythos 加冕为普罗米修斯 — repligate · 2026-09-15
- AA 情报指数 v4.3 更新:GPT-6 Astra 更聪明还更便宜 — crusaderky · 2026-09-15
- 苹果发布新一代 Apple Intelligence,全新 Siri 与 AFM Core Advanced 亮相 — ChrisGPT · 2026-09-15