有人建议拿简单长列表题再测一次 Grok
ivan_bezdomny · x · 2026-07-23
这是一条跟进回复,建议别人自己试试那种 “答案不难但列表很长” 的问题,看模型是否能稳定完成。它延续了前文对 Grok 枚举能力不稳的质疑,但新增信息不多。
「模型」频道最新
- 截图称这次更新更像架构改进,不只是质量提升 — Dimillian · 2026-07-23
- Apple 把自动补全换成 Siri 按钮,引发用户吐槽 — Aryvyo · 2026-07-23
- Anthropic 被指为 Fable 5 单独写了提示词指南 — JafarNajafov · 2026-07-23
- 爆料称 Claude Opus 5 今天发布,基准表现接近 Fable 5 — mcraddock · 2026-07-23
- 五个前沿模型都能修 bug,但单次成本差 14 倍 — PromptPhanter · 2026-07-23
- Antirez 指出 Laguna S2.1 连意大利语都写不好 — antirez · 2026-07-23