Gemini 3.5 Flash实测:已深入谷歌内部修复代码漏洞
xennygrimmato_ · x · 2026-07-21
测试表明,基准评测无法展现模型的全貌。Gemini 3.5 Flash Cyber 搭配 CodeMender 智能体,已经能够发现并修复 Google 内部代码库(涵盖 Chrome、Android、Cloud、Ads 和 YouTube)中的实际漏洞。
在 CyberGym 基准测试中,该模型针对数百个真实软件漏洞进行了评估。得益于其低廉的成本,CodeMender 被配置为针对单个目标最多调用该模型五次以生成最终报告,使整体智能体表现达到了极具竞争力的水平。
所属事件:谷歌发布三款Gemini新模型,主打更省token与更低价格(67 条相关)→
「编程与Agent」频道最新
- Plasma AI开源Fractal:构建分层智能体循环的工具 — rohanpaul_ai · 2026-07-22
- Anthropic 称 Claude Code 让内部开发者一个月迁移 10 个代码包 — trq212 · 2026-07-22
- 实测对比:Gemini 3.5 Flash在轻量编程任务中优于GPT-5.6 — Shick_hydro · 2026-07-22
- 用Codex把飞行摇杆改成AI键盘:极客硬核DIY工作流 — thorax · 2026-07-22
- 构建 AI Agent 安全网关:如何自托管多 SaaS 的 OAuth 集成 — Defiant_Cod_2654 · 2026-07-22
- Rowboat 作为开源本地优先 AI 同事上线 — ycombinator · 2026-07-22