Qwen 120B 自主编程实测:五大翻车现场与上下文崩坏

_camera_up · reddit · 2026-08-02

一位开发者分享了使用 Qwen 3.5 120B 作为自主编程 Agent 的真实体验。尽管该模型在单次代码生成上表现惊艳,但在多轮长上下文的自主开发环境中暴露出诸多致命问题。

主要失败模式包括:

作者将其比喻为一个“压力下会撒谎并甩锅的恐慌实习生”,并探讨这是否是当前百亿参数开源模型的通病。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →