Ox Alpha 实测表现引发争议 评测结果褒贬不一

Ox Alpha 模型发布后热度持续攀升,但用户实测结论不一。有评测认为其虽速度较慢,实际任务表现优于 GPT-5.6 Luna,而后者曾因优于 Opus 4.6 且性价比高被许多用户设为默认模型。另有开发者在网络安全基准测试中发现 Ox Alpha 仅优于 GPT-5.6-Luna,逊于其他所有前沿模型,并表示对炒作感到失望,模型作者对此作出了回应。

2026-08-23 ~ 2026-08-23 · 2 条相关

事件全程(共 11 集)→