实测:Ox-Alpha 表现不及预期,数学能力差
oran_ge · x · 2026-08-22
针对 Bindu Reddy 提出的 Ox-Alpha 表现不佳的观点,该回复者表示认同,并指出虽然其数学能力较差,但在其他指标上似乎表现尚可。
所属事件:Ox-Alpha 模型实测不佳被指营销噱头(3 条相关)→
「模型」频道最新
- Midjourney 发布 v8.2 版本更新 — azed_ai · 2026-08-23
- 用户反馈 Gemini Pro 近期似乎变笨 — Long_comment_san · 2026-08-23
- 实测 Qwen 3.8 27B:OCR 胜过 Gemini 3.5 Flash Lite — Cold_Specialist_3656 · 2026-08-23
- 被吹捧为 SOTA 杀手的 Gemini 新模型实测翻车 — IndraVahan · 2026-08-23
- 为何 o3 模型不太可能源自 Cursor?技术博主列三大反证 — teortaxesTex · 2026-08-23
- 开发者实测:Gemini 3.7 Flash 适合中低复杂度任务 — brandon_galang · 2026-08-23