突破科研瓶颈:Columbus-1 智能体发现蓝牙漏洞并设计火箭
EXM7777 · x · 2026-08-01
传统强化学习鼓励趋同,这与科学发现所需的发散性相悖。为此,Autopoiesislab 团队构建了全新的“判断模型”(Judgment Model)。
- 核心机制:科研过程包含无数决策(如探索什么、放弃什么),但最终论文只保留结果。该团队专门记录了这些被论文抹去的“3.5 小时(原帖笔误为 350 万小时)科研判断过程”,并以此训练模型,而非单纯依赖最终输出。
- Columbus-1 系统:基于该判断引擎构建的自主科研系统。
- 实际成果:该系统已成功发现了一个此前未知的蓝牙零点击远程代码执行(RCE)漏洞,并主导设计了一枚 10 英尺高的自着陆火箭。
「编程与Agent」频道最新
- 编码智能体成本大比拼:Claude Code 花费约为开源方案 3.7 倍 — Teknium · 2026-08-01
- Grok Build 更新:支持永久删除会话与诊断优化 — XFreeze · 2026-08-01
- 开发者用 Codex 实现 GitHub 贡献破 3000,月耗百亿 token — DeryaTR_ · 2026-08-01
- DeepSeek-V4-Flash 登顶前端代码性价比,总榜排第七 — arena · 2026-08-01
- claude-pulse: 实时监控 Claude Code 额度的状态栏工具 — tom_doerr · 2026-08-01
- 滑铁卢大学 R2L 实验室将招募 PhD,深耕智能体与推理研究 — hllo_wrld · 2026-08-01