用户实测 Grok 4.7 大失所望,称比 Gemini 系列还差
prvthvm · reddit · 2026-09-22
一位 Reddit 用户实测 Grok 4.7 后表示相当失望,直言没想到会出现比 Gemini 系列更差的模型,并提到马斯克此前曾发推宣称该模型会在所有基准上击败 Astra 与 5.1。属于个人主观体验,未附具体测试细节。
「模型」频道最新
- 安全研究者算账:像前沿实验室那样测 ExploitBench 要烧 5930 万美元 API 费 — OwariDa · 2026-09-22
- 小米发布 Qwen 3.5 9B 蒸馏模型,用 MiMo 数据 SFT 并开源 RL 环境 — teortaxesTex · 2026-09-22
- The Information:OpenAI 内部已基本自动化实验模型训练流程,新模型解出 100 道悬置数学难题 — kimmonismus · 2026-09-22
- 实测 Grok 4.7 音乐错误检测满分,比肩 GPT-6 Astra — yunta_tsai · 2026-09-22
- MiMo-V2.6 被称最大开源 RL 单次训练,登顶开源模型 — andrew_n_carr · 2026-09-22
- 开发者吐槽 AI 编码最大痛点:模型还是太蠢、太慢、太贵 — remilouf · 2026-09-22