Fable 5手搓CUDA狂飙18.7倍,Anthropic联创宣告RSI循环开始
新智元 · wechat · 2026-07-07
在全新GPU算子基准测试KernelBench-Mega中,Fable 5在RTX PRO 6000上全程自主手写CUDA,实现18.7倍加速,将第二名Claude Opus 4.8(14.4倍)和GPT-5.5(4.34倍)远远甩开。更反直觉的是,上下文越长速度越快,16K上下文时达到19.5倍。
Fable 5写出了KernelBench-Mega历史上首个真正的「超级内核」(megakernel):将int4解量化、注意力计算、MoE路由等所有操作压进单次内核启动完成,而其他所有模型需要4至14次独立启动。整个过程中,模型先花64%时间做基准测量和roofline分析,再一气呵成写完内核,发现负优化后立即回滚,全程约2.5小时、55万token。
Anthropicics联合创始人Jack Clark在其newsletter中将此定性为「递归自我提升(RSI)循环的正式开启」,称这是AI能够自主优化AI研发底层工具的标志性起点。值得注意的是,Fable 5仅是Anthropic内部模型Claude Mythos的「安全版本」。
所属事件:Fable 5登顶KernelBench,手写CUDA狂飙18.7倍(2 条相关)→
「模型」频道最新
- Artificial Analysis 发布 2025 年度 AI 状态与趋势报告 — ArtificialAnlys · 2026-07-28
- Kimi K3 将开源权重差距缩至 4 分 — ArtificialAnlys · 2026-07-28
- inclusionAI 的 LLaDA2.2-flash 在 Hugging Face 走红 — inclusionAI · 2026-07-28
- Ernos Labs AI Archive:免费自托管开源模型权重存档 — Leather_Area_2301 · 2026-07-28
- JEPA 控制 PDE 在分布外目标上追踪误差降 53% — burny_tech · 2026-07-28
- 独立 PPO 实验 3 到 4 分钟达 95% 准确率 花费约 20 美元 — ctjlewis · 2026-07-28