gpt-oss-20b 真实任务表现碾压 Opus 且成本仅千分之一

有开发者在真实任务测试中发现,gpt-oss-20b 的表现不仅碾压了 Anthropic 的 Opus 模型,而且成本便宜了上千倍。发帖者指出,如果没有持续学习,大模型的“通用性”可能被严重高估。在特定垂直任务中,经过针对性优化的轻量级开源模型已经能够以极低的成本击败昂贵的顶级闭源模型,展现出惊人的性价比。

2026-08-04 ~ 2026-08-04 · 2 条相关