评测称前沿模型实验设计品味每3个月翻倍,已超专家级AI研究员
Puzzleheaded-King584 · reddit · 2026-10-07
pzeroresearch 发布报告称,AI 现在在设计实验方面已优于专家级 AI 研究员;前沿模型的"实验研究品味"评测得分自 2025 年 12 月以来每 3 个月翻一番。完整报告见其 X 帖子。
所属事件:TasteVal 称 AI 研究品味每 3 个月翻倍已超人类专家,遭学界质疑(17 条相关)→
「漫话AGI」频道最新
- 微软首席科学家 Horvitz 播客谈:人类如何在 AI 时代掌控决策 — erichorvitz · 2026-10-08
- Scott Aaronson 将在 UT Austin 开授 AI 对齐课,首篇阅读是 Yudkowsky — teortaxesTex · 2026-10-08
- 用 Claude 做出爆款游戏的创始人遭嘲讽,老程序员:编程从来不是护城河 — mfckr_eth · 2026-10-08
- Worldpay 发布 Agentic Commerce 报告:调研 7 国 8000 名消费者 — mikeflache · 2026-10-08
- 500 万篇论文数据揭示学术出版超指数级爆发,7 张图看懂 — k7agar · 2026-10-08
- 80 年 AI 构建,人类不再写规则:AI 开始造 AI — ghadfield · 2026-10-08