Reddit 用户称 OpenAI 模型更稳定,GPT-5.5 可靠性上升
ionutvi · reddit · 2026-07-27
楼主表示,自己最近明显感觉 OpenAI 模型更稳定了:同一任务更少出现中途崩掉、重复提示词的输出更可预测,日常编码和推理工作流里的波动也变小。
帖子同时提到他自己做的 AI Stupid Level 基准,它会持续重跑实用测试、监控性能漂移,而不是只看一次性分数。按照这个追踪结果,GPT-5.5 目前被放在最可靠模型之一的位置。
「模型」频道最新
- Anthropic 推出 Claude 工作流套件:缓存、代码、设计、技能和定时任务 — aitrendz_xyz · 2026-07-27
- Gemini 前一刻能做 PDF,下一刻却说不行了 — Working-Conflict-606 · 2026-07-27
- Meta 被曝将推出 harness 并发布开源模型 — celsowm · 2026-07-27
- Similarweb 图表显示 ChatGPT 仍领跑,Meta AI 暴涨 435% — Keeltoodeep · 2026-07-27
- Reddit 用户称 Claude Opus 5 和 4.8 突然不回答问题 — sufferer540 · 2026-07-27
- Qwen3.6-27B 实测:量化越重,Spec Decode 越赚 — thavoc77 · 2026-07-27