Etched 称推理要做全栈,不只是写 kernel

AccBalanced · x · 2026-07-25

Etched 表示自家推理工作远不只是写 kernel,而是覆盖完整技术栈:从 KV cache 管理、sharding 算法 到 面向负载的 SerDes 调优。

它还强调自己会和客户一起做模型协同设计、与芯片设计方配合,并持续改进用于递归 kernel 开发的模型 harness。帖子里列出的关注点包括 KV tree masking、diffusion speculators、latent compression 和大规模 scale-up 场景。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →