实测 GPT-5.6 Luna:知识工作表现比肩 Sol,成本大幅降低

BenBajarin · x · 2026-08-01

科技分析师 Ben Bajarin 基于 Creative Strategies Bench 的评测方法指出,GPT-5.6 Luna (xhigh) 在知识工作场景下的表现已与 Sol (xhigh) 相当,但单次任务成本远低于后者。

他表示将把日常主力模型切换为 Luna,并考虑将其应用于包括重度知识工作在内的所有任务中。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →