Karpathy 揭示 AI 工程核心技能:将模糊任务转化为可验证环境
anselm · x · 2026-08-02
Andrej Karpathy 曾指出,AI 能否精通某项任务取决于该任务是否可验证。具备可验证性的任务通常满足三个条件:可重置(能重新开始)、高效(能快速运行大量尝试)、可奖励(机器能自动打分而无需人工干预)。
从就业角度看,凡是同时满足这三个条件的任务,模型都能轻易胜任;而缺失的环节,正是人类工程师的价值所在。因此,AI 工程师的核心技能其实是把模糊任务转化为可重置、可打分的环境——也就是行业内常说的 Evals(评测工程)。
「漫话AGI」频道最新
- 业务流程无需完美:LLM 自动化 80% 加人工兜底 20% — Franc0Fernand0 · 2026-08-02
- 前线 AI 工程师需求今年或暴增 2100%,但可能两年后消失 — VraserX · 2026-08-02
- AI 改变创作过程:重结果者狂欢,重过程者哀叹 — chrisalbon · 2026-08-02
- 沃顿教授:LLM 缺乏可验证性是大问题,但正随能力提升缓解 — emollick · 2026-08-02
- AI正在摧毁学术同行评审:审稿人大量粘贴LLM内容引发现象级抱怨 — Kindly-Chemical6702 · 2026-08-02
- AI在理论物理上达到超人类水平了吗? — danintheory · 2026-08-02