Etched 称推理要做全栈,不只是写 kernel
AccBalanced · x · 2026-07-25
Etched 表示自家推理工作远不只是写 kernel,而是覆盖完整技术栈:从 KV cache 管理、sharding 算法 到 面向负载的 SerDes 调优。
它还强调自己会和客户一起做模型协同设计、与芯片设计方配合,并持续改进用于递归 kernel 开发的模型 harness。帖子里列出的关注点包括 KV tree masking、diffusion speculators、latent compression 和大规模 scale-up 场景。
「编程与Agent」频道最新
- 统计学家分享 AI 协作工作流:让 AI 做叙事,人来把控数学计算 — Excellent_Copy4646 · 2026-07-25
- GitHub 截图用 41 个子智能体和 15 万行改动玩梗 — zeeg · 2026-07-25
- OpenAI 把语音接入桌面版 ChatGPT,可直接用嘴指挥 Work 和 Codex — 新智元 · 2026-07-25
- Anthropic 把 agent 记忆做成可导出可审计的文件 — VraserX · 2026-07-25
- 作者称“写代码从来不是软件工程师的工作” — gdechichi · 2026-07-25
- 开源 TokenShield 用轮次哈希拦住 CrewAI 重试死循环 — bulleykebaal · 2026-07-25