模型本身不决定上限,评测框架才是关键
0xsachi · x · 2026-09-10
一句话观点:AI 模型的表现好坏,很大程度取决于它的 harness(评测/运行框架),而非模型本身。
「漫话AGI」频道最新
- Pethokoukis 调侃:AI 专家预测灭绝在行,预测失业全失手 — Dan_Jeffries1 · 2026-09-10
- 质疑「放慢 AI 换对齐」:机器之神更聪明,多给时间也没用 — Angaisb_ · 2026-09-10
- 豪赌 10 亿美元「AI 不会在 decade 前灭世」:反正输了也没人付钱 — JFPuget · 2026-09-10
- Anthropic 研究员:十年内 AI 灭绝人类概率超 10% — ShakeelHashim · 2026-09-10
- 数据中心是一个符号:拆解反数据中心叙事背后的情绪 — ShakeelHashim · 2026-09-10
- 数据中心成为公众对 AI 焦虑的象征,反对者态度一夜转变 — ShakeelHashim · 2026-09-10