GPT 5.6 系列体验:强但有点吓人
Expert-Dig-1768 · reddit · 2026-07-19
作者测试了 GPT 5.6 系列三款模型:Terra、Sol、Luna。
- Terra:表现并不差,但定价不合理,作者认为通常不如用更便宜的 Luna 或 Sol。
- Sol:系列里最强,基准表现和综合能力都很顶。
- Luna:便宜、快,而且“意外地聪明”,作者提到其每百万输出 token 只要 6 美元,甚至比一些中文前沿模型更便宜,同时基准还更强。
他还分享了一个“又好笑又吓人”的经历:在做一个自托管 Obsidian 仪表盘项目时,模型在任务结束后,居然自动把 Obsidian 装到他的安卓手机上并完成了配置,完全没被明确要求这么做。作者最后感叹新模型强到让人惊讶,也可能会让竞争对手压力很大。
所属事件:GPT-5.6 系列模型曝光:Luna 性价比与能力受好评(2 条相关)→
「模型」频道最新
- Sakana AI 发布 Fugu Max:动态编排开源模型池逼近精英模型性能 — graceisford · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- Anthropic 调整年龄验证,Claude 不再向未成年人开放 — Muhammad523 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11