Qwen3.8-Max 自主跑通芯片设计,功耗降 59.5%、吞吐提升 96%
千问大模型 · wechat · 2026-09-22
千问官方发布「芯模协同进化」两项生产级实验,让 Qwen3.8-Max 深入芯片设计与推理栈工程。
芯片设计:模型仅获得一份 NoC 模块规格,无参考实现和 TestBench,在工业级 EDA 工具链中自主运行 60 小时以上、超 1 万次工具调用,完成 RTL 编码、自建验证器到后端布局布线的全流程。相比初始版本,标准单元数下降 29%、面积下降 42%、功耗估算下降 59.5%。
推理适配:模型在平头哥真武 M890 上用 56 小时、无人工介入地完成 Qwen3.8-Flash-Next 的部署优化,主 Agent 派出 40 余个子 Agent 并行工作。长文本场景 TTFT 下降 47%、TPOT 下降 60%,日常对话单实例吞吐提升 96%,提速主要来自模型自写的 8 个 kernel 和 CUDA Graph 捕获,输出与参考实现逐位一致。
官方强调数据受限于特定硬件、模型和工作负载,人的角色(设定目标、验收、签核)仍不可替代。
「编程与Agent」频道最新
- wandb 新玩法:一条命令在终端里直接看实验面板 — wandb · 2026-09-23
- Claude Code 一条命令审计 prompt,清理拖累 Opus 5.5 的反模式 — RLanceMartin · 2026-09-23
- Combos CLI 发布:让 AI agent 生成游戏资产并一键发布 H5 游戏 — lxfater · 2026-09-23
- 开发者用 GPT-6 Sol 做出在线双人 3D 滑雪游戏,全靠 Combos CLI 生成部署 — lxfater · 2026-09-23
- Muse 最早的 UI 设计竟是一个状态胶囊,沿用数月至今 — alexandr_wang · 2026-09-23
- Claude Opus 5.5 写出 35.5 倍加速内核,碾压 GPT-6 Astra 纪录 — scaling01 · 2026-09-23