IQuest-Q1 发布:320B MoE 模型一句话生成游戏、还能排查 RL 训练 Bug
量子位 · wechat · 2026-09-29
至知创新研究院(IQuestResearch)发布 IQuest-Q1 模型:decoder-only Transformer 主干 + 稀疏 MoE 架构,总参数约 320B、激活约 15B。
作者实测两个场景:
- 一句话生成游戏:约 200 字提示词即可生成可在竖屏手机直接玩的 HTML 小游戏《国庆卧室保卫战》,含 NPC 设定、血条与随机彩蛋机制。
- 真实工程排错:基于 ClaudeCode CLI 框架分析 RL 训练日志与轨迹,定位到推理服务文本解码时多插了一个空格,导致前缀匹配断裂、多轮生成中断的故障并修复。
评测方面,该模型在 NL2Repo、CyberGym、Terminal-Bench 2.1、DeepSWE v1.1、JobBench 等任务中表现不俗(同参数量级)。团队此前的 ModularRSI 自进化框架曾登 HuggingFace 日榜第二,可将 Agent 在 Terminal-Bench 2.0 与 SWE-Bench Verified 的准确率分别从 47.57%/73.40% 提升至 52.43%/76.45%。模型还尝试让自身参与研发迭代闭环。
所属事件:IQuest-Q1 开源:320B MoE 模型主打智能体编码(5 条相关)→
「模型」频道最新
- Plus 订阅用户收到 ChatGPT 广告投放推销,直指「付费免广告」承诺矛盾 — MugiwaraGames · 2026-09-29
- OpenAI 研究员称模型解 Navier-Stokes「完全是另一项运动」,近三月像地狱 — Confident_Salt_8108 · 2026-09-29
- ChatGPT Pro 页面悄然改版,「5x」字样消失引砍量猜测 — Rich_Business4637 · 2026-09-29
- 实测称 Anthropic 模型开 max 不划算:token 烧钱抵消单价优势 — adonis_singh · 2026-09-29
- 低档 Opus-5.5 击败 max 档 Fable-5.1,成本仅其 1/50 — adonis_singh · 2026-09-29
- Opus-5.5 与 Sonnet-5.5 视觉榜暴涨 52/50 分,仍不敌便宜的 Astra — adonis_singh · 2026-09-29