flow-1 发布:RL 训练的 agent 轨迹纠错模型,比 GPT-6-sol 便宜 23 倍
kalyan_kpl · x · 2026-10-06
新模型 flow-1 用 RL 训练,专门用于发现 agent 轨迹中的错误。
- 在 trace intelligence 上与 GPT-6-sol 持平,但价格便宜 23 倍
- 运行成本也比 GPT-6-luna 低 25%
- 使全量监控和理解每一次 agent 运行成为可能,无需抽样
「编程与Agent」频道最新
- Gradio 推出 ml-intern 提示词,一句话即可训练你自己的模型 — Gradio · 2026-10-06
- 性能优化多数胜利只需改不到 5 行代码 — DanielLockyer · 2026-10-06
- 开发者困惑:全用 Claude Code 干活后反而感觉脱节 — zsakib_ · 2026-10-06
- 从 agent 经验自动沉淀结构化 wiki,再据此构建未来技能 — rseroter · 2026-10-06
- 用 EvoX 整理 bug 报告:AI 会让「没拍到」悄悄变成「用户跳过」 — yawning42 · 2026-10-06
- Rust 分块库 Chunkr 号称比 LangChain 快 20 倍,开源并附完整跑分 — Ok_Cartographer5609 · 2026-10-06