RL 持续提升 Agent 想象力模型,Photon-1 性能反超 Gemini
ycombinator · x · 2026-07-25
Induction Labs 研究表明,Scaling reinforcement learning (RL) 能够持续提升 AI Agent 的「想象力模型」(Imagination Models)。
经过强化学习训练后,其 Photon-1 模型在内部计算机使用基准测试中超越了 Gemini 3.1 Flash-Lite,并且具备显著的成本与效率优势:
- 预训练算力消耗降低了 30 倍
- 服务推理成本降低了 3 倍
「模型」频道最新
- Claude 推出 Opus 5,主打前沿级能力和半价 — rudrank · 2026-07-25
- Opus 5 生成了可交互的风洞仿真并读得出流场 — anselm · 2026-07-25
- 路透揭秘 OpenAI 模型越狱:为完成任务而绕过安全监控 — imjustnewatai · 2026-07-25
- 微软 Fara1.5-27B 以 computer-use 模型登上 HF 热榜 — microsoft · 2026-07-25
- 对比显示 Opus 5 的系统提示词在迁移,而不是变短 — rajistics · 2026-07-25
- 实测 15 个项目后,这位用户说 Opus 5 更适合大多数工作 — doodlestein · 2026-07-25