征集下一代 GLM 评测题目
petrusenko_max · x · 2026-07-19
帖子在征集“当前模型还做不好的 prompts”,覆盖推理、编码、SVG、中文等任意方向,计划用来评估下一代 GLM。 信息量不大,但能看出他们在为后续模型做针对性测试集/评测样本收集。
所属事件:智源征集高难度提示词以评测下一代GLM(2 条相关)→
「模型」频道最新
- 有人称 OpenAI 和 Anthropic 抱怨中国开源权重模型很荒谬 — krishnan · 2026-07-21
- PrismML Bonsai 27B 量化后仅 3.8GB 可手机运行 — tony10000 · 2026-07-21
- actAVA AI 推出 1T 参数医疗代理模型 Cura — _akhaliq · 2026-07-21
- 有人觉得 Claude Fable 出现了更像 Gemini 的僵硬感 — teortaxesTex · 2026-07-21
- Reddit 实测:z.ai 上的 GLM-5.2 确实能网页搜索 — Umr_at_Tawil · 2026-07-21
- Kimi CEO 称 token 效率才是 Kimi 3 的新优势 — HowDevelop · 2026-07-21