不跑基准就发现不了:LLM 被滥用于需要真正智能的任务
generativist · x · 2026-09-23
作者吐槽当下「sloptastic」式滥用 LLM 的风气:很多任务确实需要真正的智能,用不适合的模型去做决策代价很高,而更关键的是——如果你从不同时对两类模型做基准对比,你根本察觉不到问题。Jev(杰文斯效应相关的用法趋势)是有用工具,但用对地方才有效。
「漫话AGI」频道最新
- Scale AI CEO 转评:拒绝正视 AI 对消费行为冲击是傲慢 — alexandr_wang · 2026-09-23
- ARK 分析师:AI 是史上最高效的「能量-经济」转换器,效率约为人类 10 倍 — DMaguireARK · 2026-09-23
- Google AI 科学家系统 ERA 起源:本是自动化 Kaggle 项目 — Latent Space · 2026-09-23
- Snorkel 创始人:SaaS 转 DaaS 的深层变革被大多数人低估 — ajratner · 2026-09-23
- Domingos 批 AI 暂停论:不是找问题,是根本不可行 — pmddomingos · 2026-09-23
- 研究员年中盘点:AI 进展快于预期,2028 或成美国大选主议题 — Jsevillamol · 2026-09-23