专题 · FULL STORY

GPT-5.6多端上线:全能Agent实测惊艳

OpenAI正式多端上线GPT-5.6系列模型。初期演示其具备零基础构建游戏原型能力,后续Sol等模式的实测更在3D渲染、自动研究等场景展现出全面领先的智能体实力。

2026-07-10 ~ 2026-07-14 · 5 集 · 25 条

第 1 集 · GPT-5.6预览期生成可玩小游戏Demo(2026-07-10,2 条)

Emollick在GPT-5.6预览期让模型生成了一款名为《Don't Discuss Goblins》的小游戏并公开演示。模型不仅自主提出了游戏创意,还设计了较巧妙的机制和图形,展示了GPT-5.6在游戏生成方面的能力。

第 2 集 · GPT-5.6演示从零构建可玩游戏原型(2026-07-10,2 条)

OpenAI使用GPT-5.6在Codex中演示了从零构建可玩游戏原型的强大能力。仅凭简短的开放式提示,模型便自主完成了星际主题卡牌游戏的核心机制设计、自定义美术素材生成、关卡构建与配乐添加。测试表明,GPT-5.6已能在多个制作环节输出连贯结果,直接交付像样的交互式成品。

第 3 集 · GPT-5.6 系列多端上线,全能 Agent 展示惊艳实操(2026-07-10,16 条)

OpenAI 正式在 ChatGPT、Codex 和 API 中滚动上线 GPT-5.6 系列(包含 Sol、Terra、Luna 等不同模式)。这次更新不仅强调模型变得更便宜、更快速,更展示了其作为全能 Agent 在多领域的惊人表现,引发了开发者社区的广泛热议与实测狂潮。

核心能力与高阶演示

GPT-5.6 Sol 在多媒体处理与桌面端控制上展现出极强潜力。据 @eyishazyer 整理的演示,该模型能够高速操作 Blender 并进行实时 3D 建模,甚至可以直接进行视频编辑与生成。此外,它还能连接各类应用程序,自动处理用户交代的复杂任务,并展示了驱动高速动作 RPG 的实时交互生成能力。

编程与开发工作流革新

在编程领域,GPT-5.6 Sol 通过了 Replit benchmark,并支持“Vibe code”去开发另一个语言模型。@dkundel 分享了其作为编码 Agent 的强大工作流:它能在主线程外开辟 worktree 线程,自动搜索代码库和 Slack 以补齐上下文,甚至根据内嵌演示视频直接重建出包含界面和逻辑的交互式文档,挽救了原本因时间紧迫要被砍掉的开发功能。

横向对比与社区反响

在模型对比方面,多位作者将 GPT-5.6 Sol 与 Claude Fable 5 进行了游戏构建对决。@minchoi 与 @Matt Wolfe 指出,GPT-5.6 Sol 擅长从单条提示词一次性生成完整游戏项目,在“设计感”上更让人意外。@eyishazyer 更是直接评价 GPT-5.6 Sol 为“scary good(强得可怕)”,而 @svenai 也发起了关于这两大模型对决的社区讨论。

第 4 集 · GPT-5.6 Sol 演示爆火:零基础3D渲染与论文复现(2026-07-14,3 条)

近期 GPT-5.6 Sol 的多项演示引发热议。实测显示,该模型能让零基础用户在几分钟内搭建 Blender 环境并渲染出专业级 3D 画面。在自动研究方面,它可自主处理歧义并复现 LLM 论文的关键发现,相比前代及竞品更加专注果断。此外,它在快速编写代码和修复 Bug 等开发任务中也展现出惊人效率。

第 5 集 · GPT-5.6 Sol 实测:开发与研究能力全面领先(2026-07-14,2 条)

GPT-5.6 Sol 的最新实测案例展现了其在多场景下的卓越表现。在应用构建对比中,其速度与决策果断性均优于竞品 Fable,并能主动推进任务。在自动研究场景下,相比 GPT-5.5,它减少了无关追问,能自主处理歧义并高效复现论文发现,展现出极强的复杂任务执行力。