Prime Intellect 称在 OpenRouter 上 GLM-5.3 工具调用错误率领先
xeophon · x · 2026-10-12
Prime Intellect 宣布其模型在 OpenRouter 的 GLM-5.3 上工具调用错误率领先,强调可靠工具调用是长程 agent 任务的关键。转发者 xeophon 表示终于不用再为 provider 调试头疼。
「模型」频道最新
- 用户细评 Opus 5.5:聪明讨喜但过度讨好,倾向自我抹除 — repligate · 2026-10-12
- 开发者实测:Vertex AI 版 Gemini 疑似隐藏开发者提示拦截浪漫角色扮演 — zxcshiro · 2026-10-12
- 截图实锤:Gemini 界面显示 Pro High 实际跑的是 3.8 Flash,模型自曝身份 — AssociateFirst6296 · 2026-10-12
- Matthew Berman:不报 tokens/s 就说机器能跑哪个模型没有意义 — MatthewBerman · 2026-10-12
- OpenAI 未发布模型单次提示解出多数数学题,每题思考约 3 小时 — Puzzleheaded-King584 · 2026-10-12
- GPT-6 Astra 72 小时长任务精确收工,准时率 63% 远超对手 — maksym_andr · 2026-10-12