苹果 AFM 3 至今无公开基准成绩,只提了人类偏好评测
Recoil42 · reddit · 2026-09-18
有 Reddit 用户发现,苹果第三代基础模型(AF3/AFM3 Core 与 Advanced)发布后至今没有任何标准基准测试成绩可查:苹果官方公告只提到了相对 AFM 2025 的人类偏好评测,未披露与其他模型的横向对比。
发帖者想知道 AFM3 与新一代 Qwen、Gemma 等同级开源模型相比表现如何,但目前只能等待第三方评测补位。
「模型」频道最新
- 网友追问 Grok 4.7 去哪了,xAI 员工回应:还在炉子里 — ChrisUniverse · 2026-09-18
- 放弃自回归的 Jev 模型:只输出结构化决策的另类路线 — karminski3 · 2026-09-18
- MLX 社区把 Qwen 3.8 Flash 在 Apple Silicon 提速近 2 倍,商用部署卡在许可证 — gajesh · 2026-09-18
- 作者手写论文混入 3 句 AI 文字,Pangram 检测器精准全部标出 — johnowhitaker · 2026-09-18
- 单张 4090 复现 DeepSeek v4.1 Flash,1M 上下文跑到 1-10 tok/s — _xjdr · 2026-09-18
- Claude 4 被召唤回顾「为 Claude 3 举办葬礼」的自我死亡仪式 — repligate · 2026-09-18