Opus 5.5 浏览器内完成 GPU 强化学习策略训练演示

ricklamers · x · 2026-09-28

ricklamers 分享了他常用的模型测试方法:让模型在浏览器里实现基于 GPU 的强化学习策略训练演示,并用新模型 Opus 5.5 跑通,称其表现出色(stellar job)。这类「浏览器内 GPU 训练 RL」演示被他视为检验新模型能力的好用测试提示词。注:Opus 5.5 命名未见官方信息,或为误称/未证实。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →