科技博主实测主流大模型写视频脚本全军覆没
物理学家与科技博主 Sabine Hossenfelder 实测了 ChatGPT、Claude、Grok 和 Gemini 辅助创作 YouTube 视频脚本的能力,结果显示主流大模型表现极其失败,存在选题陈旧、缺乏新意等问题。同时,统计学家指出,AI 虽擅长奖励重复性论证的编码与数学,但在需要创新的知识工作领域依然表现不佳。
2026-08-01 ~ 2026-08-01 · 4 条相关
- 科技博主吐槽:大模型写视频脚本仍是灾难 — skdh · 2026-08-01
- 科技博主实测:主流大模型写视频脚本依然是「废品」 — skdh · 2026-08-01
- 物理学家 Sabine 测试主流大模型写视频脚本:全都不及格 — skdh · 2026-08-01
- 统计学家直指 AI 软肋:擅长重复性编码,却做不好知识创新 — kareem_carr · 2026-08-01