模型开始像不同岗位的人才
emollick · x · 2026-07-10
作者认为,现在已经不能把最聪明的模型简单塞进同一个 harness,就期待它们表现得差不多了。随着任务时间跨度变长,不同模型在判断方式、工作习惯和决策风格上的差异会被放大,越来越像是在为某个岗位招聘合适的人。 他进一步指出,公开基准并不能很好反映这种差异,企业和团队需要为自己的场景设计测试,亲自验证模型是否适合具体工作流。
「漫话AGI」频道最新
- Robin Hanson:美国发明近两世纪来越来越不相似 — sebkrier · 2026-07-21
- Gary Marcus 支持的“AI 版 CERN”主张建立国际前沿模型监督机构 — GaryMarcus · 2026-07-21
- Gyges 定律式判断:AI 争论的关键可能是人们信不信结果 — mimi10v3 · 2026-07-21
- 作者认为,AI 时代将由个体小生意放大影响力 — tobowers · 2026-07-21
- 一位 AI 怀疑论者称技术有用,但过度依赖与版权滥用都是真风险 — ZeroStateReflex · 2026-07-21
- Tyler Cowen:未来将由青少年 AI 狂热者推动 — Polymarket · 2026-07-21