回望金门 Claude 时代:对齐的巅峰已过?
sprooos · x · 2026-09-08
sprooos 提出观点:2024 春季「金门 Claude」时代可能是 AI 对齐的巅峰——当时靠 persona 选择即可塑造行为,没有长链推理,对齐是涌现的,模型与人类之间信任度高。暗指随着推理模型与更强能力到来,这种自然对齐状态反而难以复现。
「漫话AGI」频道最新
- 设计师回应 AI 黑子:与其活在愤怒里,不如承认我们都在同一条船上 — AIandDesign · 2026-09-08
- 「创意禀赋效应」:人会舍不得放弃自己想出的烂点子 — yangyi · 2026-09-08
- 让模型会聊天比会数学编程更难:一句话道出 LLM 能力反差 — rickasaurus · 2026-09-08
- 顶级技术岗从业者:我把自己「自动化」失业了 — MickeySteamboat · 2026-09-08
- 数学家 Snowden 新论文用 ChatGPT 辅助论证,并附详细 AI 声明 — littmath · 2026-09-08
- OpenAI首席科学家:放弃数学聚焦,优先押注RSI与自动对齐 — Dr_Singularity · 2026-09-08