Gemini 4 Argon 发布:DeepSWE 得分 77.9%,超 Claude Opus 5.5 的 74.2%
dl_weekly · x · 2026-10-10
Google 发布 Gemini 4 Argon。据 DL Weekly 本周刊物,该模型在 DeepSWE v1.1 上得 77.9%,高于 Claude Opus 5.5 的 74.2%;并通过 Fairwind Program 面向 650 多名防御类用户首发,价格为每百万 tokens 输入/输出 2/10 美元(按帖文表述)。
「模型」频道最新
- 安全研究员:漏洞赏金用开源模型就够,闭源模型对黑盒目标更犹豫 — rez0__ · 2026-10-10
- OpenAI 推 GPT-6 Sol/Luna:ChatGPT 智能界面实时生成可视化 — aidan_mclau · 2026-10-10
- OpenAI 研究员:新模型更诚实,但评测觉察威胁安全测量 — ericmitchellai · 2026-10-10
- 爆料称 Google 或已突破递归自我改进,三大实验室逼近 RSI — imjustnewatai · 2026-10-10
- 把「数学家」换成「医生」:AI 圈群嘲大模型数学论断的傲慢 — NachoSoto · 2026-10-10
- 用户称已逼近 Grok 每周用量上限,呼吁 xAI 翻倍额度 — nima_owji · 2026-10-10