Opus 5.5 浏览器内完成 GPU 强化学习策略训练演示
ricklamers · x · 2026-09-28
ricklamers 分享了他常用的模型测试方法:让模型在浏览器里实现基于 GPU 的强化学习策略训练演示,并用新模型 Opus 5.5 跑通,称其表现出色(stellar job)。这类「浏览器内 GPU 训练 RL」演示被他视为检验新模型能力的好用测试提示词。注:Opus 5.5 命名未见官方信息,或为误称/未证实。
「编程与Agent」频道最新
- Yacine 观察:三周内三家不同行业公司要做定制内部软件,风口将至 — yacinelearning · 2026-09-28
- 开发者晒单:四周跑完 12000 个 AI Agent — airesearch12 · 2026-09-28
- 用内置向量搜索做语义 Emoji 选择器 — firasd · 2026-09-28
- 分类模型 Jev 爆火:把早晨新闻筛查从 20 条扩到 500 条 — every · 2026-09-28
- 开发者拟让 Codex 决定跑哪些测试,大幅削减 CI 成本 — sull · 2026-09-28
- 编程工具频繁换血,开发者呼吁用 MCP 把能力与 harness 解耦 — mostly_deterministic · 2026-09-28