大模型再现新莫拉维克悖论:擅长解数学难题却搞不定日常指令

近期多位业界观察者与开发者指出,当前大模型正展现出一种荒谬的能力错位:它们能解决复杂的开放性数学难题,却在修改账单、遵循简单指令等日常任务中频频翻车,甚至白白消耗上千万Token与数百美元。这种反差揭示了模型在抽象推理与处理现实繁杂规则之间存在巨大鸿沟,引发了对AI实际落地能力的反思。

已确认

为什么重要

2026-08-02 ~ 2026-08-03 · 8 条相关

一手来源