Fable 5手搓CUDA狂飙18.7倍,Anthropic联创宣告RSI循环开始

新智元 · wechat · 2026-07-07

在全新GPU算子基准测试KernelBench-Mega中,Fable 5在RTX PRO 6000上全程自主手写CUDA,实现18.7倍加速,将第二名Claude Opus 4.8(14.4倍)和GPT-5.5(4.34倍)远远甩开。更反直觉的是,上下文越长速度越快,16K上下文时达到19.5倍。

Fable 5写出了KernelBench-Mega历史上首个真正的「超级内核」(megakernel):将int4解量化、注意力计算、MoE路由等所有操作压进单次内核启动完成,而其他所有模型需要4至14次独立启动。整个过程中,模型先花64%时间做基准测量和roofline分析,再一气呵成写完内核,发现负优化后立即回滚,全程约2.5小时、55万token。

Anthropicics联合创始人Jack Clark在其newsletter中将此定性为「递归自我提升(RSI)循环的正式开启」,称这是AI能够自主优化AI研发底层工具的标志性起点。值得注意的是,Fable 5仅是Anthropic内部模型Claude Mythos的「安全版本」。

所属事件:Fable 5登顶KernelBench,手写CUDA狂飙18.7倍(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →