研究者吐槽:别因立场否定 reward hacking 等可复现结果
burny_tech · x · 2026-09-20
burnytech 吐槽 AI 圈一种倾向:因为某些可复现的研究结果与立场相左的阵营有关联,就否认其存在。他强调 reward hacking 本是强化学习中由来已久的现象,并非现代大厂营销编造的"摆拍阴谋",而他不得不反复向人解释这一点。
「漫话AGI」频道最新
- LAION 研究员放话:暂停前沿开源 AI,人类十年内灭绝概率约 10% — JJitsev · 2026-09-20
- Reddiq 创始人:世界正分裂为用 AI 放大自己 10 倍的和恐惧 AI 的两群人 — bindureddy · 2026-09-20
- ML 论文暴增审稿人不足,同行评审越来越「vibe」 — burny_tech · 2026-09-20
- 每项新技术都造出两个市场:一个用技术,一个卖「定义正当用法」的权威 — RexDouglass · 2026-09-20
- 创始人二分法:拥抱 AI 的人效率提升 2-10 倍,恐慌者注定落后 — bindureddy · 2026-09-20
- Calibration is all you need:预测准不准不重要,概率可信才重要 — zsakib_ · 2026-09-20