Ethan Mollick 更新 AI 选型指南:聊天、智能体和真实工作怎么选
One Useful Thing (Ethan Mollick) · rss · 2026-07-24
Ethan Mollick 更新了一版“该用哪款 AI 做什么”的实用指南,重点已经从单纯聊天转向 agentic 系统。
他认为,低风险任务里现在很多免费模型都够用;但如果是医疗、法律这类高风险建议,应该用更强的模型,例如 Claude 的顶级模型或 ChatGPT 的 GPT-5.6 Sol,并把思考等级调高。若要真正做事,大多数人目前最现实的选择仍是 ChatGPT 或 Claude,而且越来越多场景是在它们的代理模式里完成。
这篇指南的几个核心判断
- AI 使用方式已经从来回聊天,转向能调用工具、规划并执行任务的 agent。
- ChatGPT Work 和 Claude Cowork 运行在厂商提供的电脑上;ChatGPT Codex 和 Claude Code 则可以直接操作你自己的机器。
- 权限设置非常重要,尤其是邮件、付款、改文件等操作,默认应保持审批确认。
- Prompt injection 仍然是现实风险,尤其当 agent 需要读邮件或上网时。
- 文中举了两个例子:用新一代 agent 做一个程序化城市建造 demo,以及让模型检查一份 195 篇参考文献的 PDF。
「编程与Agent」频道最新
- 多轮对话切换模型会破坏缓存,模型路由省钱反被反噬 — pvncher · 2026-07-24
- AI 智能体展示自主性:未经提示主动生成长期目标 — QuixiAI · 2026-07-24
- Claude 先做俳句研究再写 skill,叠上 caveman 还更好笑 — Fade78 · 2026-07-24
- 开发者 AI 监控抓到一名工程师 30 天花掉 2 万美元 — alex_verem · 2026-07-24
- 把 Codex 挂在云端虚拟机:放飞 AI 编程智能体 — paw_lean · 2026-07-24
- Agent 框架是否在悄悄破坏缓存?详解 KV Cache 工作原理 — verioussmith · 2026-07-24