Qwen3.8-Max 自主跑通芯片设计,功耗降 59.5%、吞吐提升 96%

千问大模型 · wechat · 2026-09-22

千问官方发布「芯模协同进化」两项生产级实验,让 Qwen3.8-Max 深入芯片设计与推理栈工程。

芯片设计:模型仅获得一份 NoC 模块规格,无参考实现和 TestBench,在工业级 EDA 工具链中自主运行 60 小时以上、超 1 万次工具调用,完成 RTL 编码、自建验证器到后端布局布线的全流程。相比初始版本,标准单元数下降 29%、面积下降 42%、功耗估算下降 59.5%。

推理适配:模型在平头哥真武 M890 上用 56 小时、无人工介入地完成 Qwen3.8-Flash-Next 的部署优化,主 Agent 派出 40 余个子 Agent 并行工作。长文本场景 TTFT 下降 47%、TPOT 下降 60%,日常对话单实例吞吐提升 96%,提速主要来自模型自写的 8 个 kernel 和 CUDA Graph 捕获,输出与参考实现逐位一致。

官方强调数据受限于特定硬件、模型和工作负载,人的角色(设定目标、验收、签核)仍不可替代。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →