Etched 称推理要做全栈,不只是写 kernel
AccBalanced · x · 2026-07-25
Etched 表示自家推理工作远不只是写 kernel,而是覆盖完整技术栈:从 KV cache 管理、sharding 算法 到 面向负载的 SerDes 调优。
它还强调自己会和客户一起做模型协同设计、与芯片设计方配合,并持续改进用于递归 kernel 开发的模型 harness。帖子里列出的关注点包括 KV tree masking、diffusion speculators、latent compression 和大规模 scale-up 场景。
「编程与Agent」频道最新
- Kernel 接入 Stripe Link:浏览器 Agent 一行 API 即可安全付款 — jeff_weinstein · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 3D 网站生成工作流公开:MCP 接 Codex,一句话出可玩游戏 — FellMentKE · 2026-09-11
- 用 GPT-6 Astra 加 Hyper3D MCP 免建模做 3D 落地页 — FellMentKE · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11