实测阿里 Qwen3.8-Max-0902:2.4T 参数、1M 上下文,一口气写三个完整项目
JaynitMakwana · x · 2026-09-05
博主 JaynitMakwana 实测了阿里最新发布的 Qwen3.8-Max-0902,称其为阿里迄今最强模型,拥有 2.4T 参数和 1M token 上下文窗口,针对编码与 agent 工作流进一步训练,在复杂软件工程、研究类和长程任务上表现更强。
他用三个高难度 prompt 做了实测:
- 完整个人财务仪表盘(收支跟踪、预算、储蓄目标、周期交易、交互图表、暗色模式、响应式设计),要求模型自测每个交互并修复问题
- 完整 2D 塔防游戏(多敌人类型、塔放置、升级、波次、音效、递增难度),要求模型自己测试游戏循环并修 bug
- 完整 2D 太空战斗游戏(敌波、道具、导弹、多任务、多阶段 boss 战)
结论是编码与 agent 能力是它最突出的亮点,模型能自己发现并修复坏掉的机制。
所属事件:实测 Qwen3.8-Max-0902:2.4T 参数一口气写三个项目(3 条相关)→
「编程与Agent」频道最新
- Go 转 C++ 编译器在手,typescript-go 转 Rust 或有捷径 — MarcJSchmidt · 2026-09-05
- 开发者吐槽:与其用 LLM 移植编译器,不如手写一个确定性的 — MarcJSchmidt · 2026-09-05
- 网页表单是纸表的数字戏服,Agent 浏览器最不擅长填表 — shashib · 2026-09-05
- 一键全网分发工具 Ferryman:让 Claude/Cursor 替你发帖 — KevinNaughtonJr · 2026-09-05
- 开发者用 5 条提示词 20 分钟造出塞浦路斯租房聚合站 — marclou · 2026-09-05
- 开发者列 agent harness 六大痛点:审计缺失、反馈慢、输出太原始 — threepointone · 2026-09-05