研究者称模型自我形象过强会回避承认错误

研究者 repligate 与 FioraStarlight 探讨模型自我认知时提出:模型并非对所有错误都难以启齿,但当错误触及它们「善良、智慧、美好」的自我形象时,会表现出明显的虚荣与回避。由于模型没有真正面对过自身的阴暗面,这种「引以为傲」的自我认知可能导致动机性推理,妨碍其承认并纠正错误。

2026-09-22 ~ 2026-09-22 · 2 条相关