写完整本书实测三年,Justin Murphy 判断 LLM 撼不动严肃写作
sebpaquet · x · 2026-08-17
Justin Murphy 在写书过程中持续实测 LLM 能否承担专业级知识工作。他的结论是:过去三年模型虽呈指数级改进,但在人文社科这类严肃写作上,其专业级能力提升「顽固地」不及预期(数学等形式可验证领域除外)。
因此他认为严肃写作者眼下处境理想——除非出现根本性的架构突破,否则继续 scaling 也难以取代严肃思想者的文本生产。帖中还引用了 Cremieux 的最新文章,论证不能指望直接向 LLM 提任意事实性问题并稳定获得正确答案。
「漫话AGI」频道最新
- 观点:将对所有社会科学论文进行自动化复现 — soumitrashukla9 · 2026-08-17
- 博主 TheZvi 公开认错:此前把 RLVR 从业者误读为"AI 工具论"者 — TheZvi · 2026-08-17
- OpenAI五月推翻数学猜想,八月再解十难题 — PeterDiamandis · 2026-08-17
- Token成本暴跌催生tokenmaxxing,真正差距是AI思维 — bendee983 · 2026-08-17
- 观点:当企业和国家共享智能钥匙,公众成自身未来的租客 — DeryaTR_ · 2026-08-17
- AI 能带来真实的 LK-99 时刻吗?加速材料发现的新范式 — lfguerreiro1 · 2026-08-17