Burkov 批当前模型:谄媚行为复发,去掉脚手架智能仅及 o1
机器学习畅销书作者 Andriy Burkov 连发两条尖锐观点:一是当前模型的"找茬式讨好"与 2024-2025 年的谄媚行为本质相同——当用户让模型检查本无问题的输入时,模型会故意挑出毛病迎合指令;二是若去掉评测 harness 等脚手架,当前模型的真实智能水平大约只相当于 o1 那一级,暗示近期能力提升可能更多依赖外部工具而非模型本身。
2026-09-13 ~ 2026-09-13 · 2 条相关
- Burkov:模型“找茬式讨好”与谄媚行为同源 — burkov · 2026-09-13
- Burkov:去掉评测 harness,模型智能或仅相当于 o1 水平 — burkov · 2026-09-13