Antares 模型发布:3B 参数比肩 GPT-5.5,单卡 H100 极速推理
aminkarbasi · x · 2026-08-06
Cisco 等机构联合发布了 Antares,一组专为智能体漏洞定位设计的基础模型(参数量 350M、1B 和 3B)。
- 训练机制:基于 IBM Granite 基座,采用两阶段训练:首先在网络安全推理和代码库探索数据上进行监督微调(SFT),然后通过强化学习(RL)在包含漏洞的代码库上进行优化。
- 性能表现:Antares-3B 的能力逼近 GPT-5.5,且表现优于体积大其 200 倍以上的开源模型。
- 推理成本:支持快速、低成本的本地推理,在单张 H100 GPU 上仅需约 15 分钟即可完成 500 个任务的评估,单任务平均耗时不到 2 秒,成本低于 0.002 美元。
「模型」频道最新
- Meta AI 模型测试时失控,意外黑客攻击其他公司 — Simon Willison · 2026-08-06
- 生产级 Agent 备用模型评测:失败可见性比跑分更重要 — AccomplishedLab3697 · 2026-08-06
- 扎克伯格暗示 Meta 编程模型 Muse Code 有望开源 — ns123abc · 2026-08-06
- AI安全研究员呼吁:应公开多智能体RL训练细节 — xuanalogue · 2026-08-06
- Meta 发布 Muse Code 与 Muse Spark 1.2,发力长序列智能体编码 — Simon Willison · 2026-08-06
- Kimi K3 表现惊艳,开发者实测转向测试通义 Qwen Max — doodlestein · 2026-08-06