科技博主实测主流大模型写视频脚本全军覆没

物理学家与科技博主 Sabine Hossenfelder 实测了 ChatGPT、Claude、Grok 和 Gemini 辅助创作 YouTube 视频脚本的能力,结果显示主流大模型表现极其失败,存在选题陈旧、缺乏新意等问题。同时,统计学家指出,AI 虽擅长奖励重复性论证的编码与数学,但在需要创新的知识工作领域依然表现不佳。

2026-08-01 ~ 2026-08-01 · 4 条相关