GPT 5.6 Sol 被指严重偏好 Python,多语言支持失衡
jyangballin · x · 2026-08-11
测试显示,GPT 5.6 Sol 在 ProgramBench 重构代码时表现出极强的 Python 偏好。尽管原始测试集由 54% 的 Rust、23% 的 Go、16% 的 C 和 6% 的 C++ 组成,但模型将 165 个程序都用 Python 重写,仅有 12% 的代码保留了原始编程语言。
所属事件:GPT 5.6 Sol 登顶 ProgramBench,重构成本减半但偏科 Python(6 条相关)→
「模型」频道最新
- DeepSeek Harness v4 发布,Logo 曝光 — teortaxesTex · 2026-08-11
- 曝 OpenAI 新模型预训练代号 Doug,此前曾落后 — weswinder · 2026-08-11
- 吐槽:受够了吹捧便宜模型达到 Opus 水准的评测水文 — xeophon · 2026-08-11
- Muse Glimmer 智能体评测落后,但工具调用与幻觉控制优于同级 — ArtificialAnlys · 2026-08-11
- OpenAI 推出限制更少的模型,专供网络安全防御者使用 — lofty23_smart · 2026-08-11
- 坐拥算力与数据优势,谷歌顶级模型为何仍不敌 Claude 与 GPT? — prasenx · 2026-08-11