Cacheon 开设 GLM-5.3 内核竞技场,优化推理内核日奖励可达 33 TAO
JosephJacks_ · x · 2026-09-08
推理优化竞赛平台 Cacheon 宣布上线 GLM-5.3 竞技场(arena),矿工(参与者)可提交内核优化并获得协议奖励。
运作方式:
- 参与者用 Triton 或 CuteDSL 编写 GPU 内核,目标固定模型中的算子、融合块或跨 GPU 集合通信
- 以 sglang 为基线:同模型、同机型、同 prompt,在同等保真度(KL fidelity 与基准精度不回退)下跑得更快即可加冕
- 奖励按提速幅度发放,最高每天 33 TAO(以 SN14 代币支付,法币价值随行情波动)
已有战果:RMSNorm 内核提速 37%,集合通信算子提速 12%,Attention 块尚无人挑战。项目宣称该子网具备生产使用与变现的巨大机会。
「Infra」频道最新
- AI 机柜光互连供应链拆解:InP 衬底与硅光或是更干净的上游布局 — demian_ai · 2026-09-08
- Hugging Face 自研 WebGPU 推理引擎亮相:实验提速 5-10 倍 — nicodotdev · 2026-09-08
- PyTorch 大会将深讲 Meta 推荐系统推理优化实战 — PyTorch · 2026-09-08
- AI 挤压存储 supply,4TB 移动 SSD 涨价惊呆开发者 — demian_ai · 2026-09-08
- NVIDIA Sol 助 MiniMax-H3 提速:8 卡 B300 上 5 秒视频 1.653 秒生成 — MiniMax_AI · 2026-09-08
- GLM-5.3-Flash 极致量化版跑上 DGX Spark,带视觉 18-25 tok/s — pbaylies · 2026-09-08