Anthropic模型在多模态编程基准上稳步提升,90%指日可待
jyangballin · x · 2026-09-01
开发者jyangballin评论称,到2026年,通过视觉(而非文本)调试GitHub问题仍未完全解决。自Opus 4.7以来,Anthropic模型在多模态性能上稳步攀升。他认为在该基准上达到90%以上只是时间问题。
「模型」频道最新
- 用户吐槽 Claude 频繁回复“不知道要做什么” — doooyle · 2026-09-01
- 8 亿参数微调模型在特定任务击败 GPT-5.6 — sachdh · 2026-09-01
- 质疑 AtomicChat 假冒 Q4 量化实为 Q2 — po_stulate · 2026-09-01
- 新基准 PACT 揭示企业 AI 助手在压力下的合规漏洞 — baseten · 2026-09-01
- Grok 4.6 生物安全评测:拒绝危险查询且能力不减 — kenbwork · 2026-09-01
- GPT Astra 单文件复刻 Terraria,自研引擎做游戏 — i_dg23 · 2026-09-01