Teknium 称 Anthropic Opus 5 在 Hermes agent 中表现更差
Teknium · x · 2026-07-28
Teknium 说他又切回了 Fable,因为他测试下来 Opus 5 的表现比 Opus 4.6–8 还差。
他提到这个新模型在 Hermes agent 里引发了不少严重问题,因此自己已经不会再用了。他还补充说,自己通常只信 Anthropic 对模型 benchmark 的说法,但这次不是“嘴硬”,而是实际体验确实出问题。
这条更像是用户侧的真实故障反馈,不是官方评测;但它确实给出了模型在 agent 工作流里退化的一个强信号。
「编程与Agent」频道最新
- Supermemory 试图打通 Claude Code、Cursor 和 Gemini 的共享上下文 — builditwithjoe · 2026-07-28
- NousResearch 的 Hermes Desktop 露出边框外的 AI 编程桌面 — max_paperclips · 2026-07-28
- Vibe-coding 调试笔记:原始工具调用抓出真实 bug — andrey_kurenkov · 2026-07-28
- 一份 2026 阅读清单:agent harness、Gemma 4 本地基准与 AI 基础设施 — rseroter · 2026-07-28
- Codex 给客户做网站时,竟和 Gemini 互相“对话” — DumpingSouptime · 2026-07-28
- youtube-skills 为 AI Agent 提供 YouTube 字幕搜索接口 — tom_doerr · 2026-07-28