私下基准测试:0x Alpha 低推理配置表现不佳
toptickcrypto · x · 2026-08-22
用户分享了对模型“0x Alpha”的私人基准测试结果。在一个较为严苛且无数据污染的私有基准上,即使在给予推理优势的情况下,该模型的表现依然明显低于预期。
「模型」频道最新
- Claude Security 现由 Mythos 5 驱动,支持跨文件漏洞追踪 — claudeai · 2026-08-22
- Ox Alpha 模型实测:在 Pi Harness 中表现惊艳 — omarsar0 · 2026-08-22
- LLM 生成诡异文本,疑是合成数据中的自我对话 — ctjlewis · 2026-08-22
- Ornith 1.5 35B上线RunInfra:缓存后输入约每百万$0.02 — alejandroll10 · 2026-08-22
- 开发者质疑 Ox-alpha 模型表现,或为营销噱头 — bindureddy · 2026-08-22
- SemiAnalysis 深度:开源模型正在追上闭源前沿模型吗? — JosephJacks_ · 2026-08-22