用户吐槽 grok-4.7 拒答率超高,难说服且表现平庸
intellectronica · x · 2026-09-24
开发者 electronica 发推称 grok-4.7 除了整体表现一般之外,还是一个「铁杆拒绝者」:大约每三次请求就有一次被拒,且无法通过 persuasion 让它放行,拒答情况比他见过的 Anthropic 或 OpenAI 模型都严重,完全出乎意料。
「模型」频道最新
- JevBench 新增双图表:能力与成本、速度分轴呈现不再合成单一分数 — airesearch12 · 2026-09-24
- JevBench v1.4.1 评分门控:智能分低于 50 触发降级,分差达 27.5 — airesearch12 · 2026-09-24
- Codex 用户询问升级 20x 套餐后用量重置是否保留 — justalexoki · 2026-09-24
- ChatGPT 免费用户可无限次对话 GPT-5.6 Luna,附滥用防护限制 — hey_abusiddik · 2026-09-24
- JevBench 榜单:DeepSeek 便宜 15 倍,性价比与榜首差距悬殊 — airesearch12 · 2026-09-24
- Altman 宣称 OpenAI 模型已解千禧年大奖难题 Navier-Stokes — victor_explore · 2026-09-24