Claude V4-Flash 被指存在视觉缺陷,频繁自建程序绕过
teortaxesTex · x · 2026-08-01
有开发者在测试中发现,Claude V4-Flash 模型似乎存在视觉能力缺陷。即使为其配置了视觉子智能体,模型在几乎每次运行中仍会尝试通过编程手段自行构建图像解析能力(如“像素取证”),而不是直接调用现成的视觉工具。
「模型」频道最新
- 实测多款Agent框架:Kimi K3轻量化表现佳,Claude成本高 — omarsar0 · 2026-08-01
- agentic RL 赋予 LLM「生命力」:模型变得狂热且投入 — teortaxesTex · 2026-08-01
- 实测用 ChatGPT 在 iPhone 上直接生成应用 — reach_vb · 2026-08-01
- Kimi K3 登顶开源 ARC-AGI 评测,比肩 Claude Opus — mhmazur · 2026-08-01
- Jeremy Howard 评大模型防越狱:封杀预填充将逼用户转向开源 — jeremyphoward · 2026-08-01
- OpenAI 宣布 GPT-5.4 模型将于 8 月底从 ChatGPT 下线 — OpenAIDevs · 2026-08-01