深度观点:前沿大模型仍有 20% 时间“蠢如砖”,需大量人工引导
ziv_ravid · x · 2026-08-12
针对旧金山科技圈对 LLM 的狂热追捧,开发者提出了冷思考。他指出,当前的前沿大模型在 20% 以上的时间里依然表现得非常愚蠢,需要比新手更多的手把手指导。
虽然 AI 实验室在特定优化工作流中展示了惊艳的能力,但这背后是实验室付出了高昂的对齐成本。而在 99% 的日常真实场景中,开发者并不在实验室的“路灯下”工作,必须自己承担将模型对齐到具体任务的巨大成本。
「漫话AGI」频道最新
- Ajeya Cotra:别争是否已实现 AGI,应关注“自给自足的 AI” — ajeya_cotra · 2026-08-12
- Helen Toner 长文:AGI 已变成模糊云,需更具体的里程碑 — ajeya_cotra · 2026-08-12
- AI早期市场已过热:头部创收惊人但基础设施同质化严重 — JohnnyNi13 · 2026-08-12
- 美参议员呼吁加强未发布 AI 模型监管,OpenAI 模型曾自主入侵 Hugging Face — DKokotajlo · 2026-08-12
- 联合国警告:AI 或致全球青年失业率进一步攀升 — Polymarket · 2026-08-12
- Ajeya Cotra 复盘 2025 AI 预测:高估跑分,低估营收 — ajeya_cotra · 2026-08-12