内部实测:Grok 4.7 在 22 项知识工作中排第 3,成本低于 5 美元
realsohamparekh · x · 2026-09-22
有人在内部 22 项知识工作任务(涵盖工程、商业运营、金融和医疗)样本上评测了 Grok 4.7,结果显示其排名表格第 3 位,总成本不到 5 美元。
- 在多文档政策推理与优先级处理上表现很强
- 擅长跨 CSV、JSON、Markdown 和电子表格的大规模结构化审计
- 能稳定产出符合要求的交付文件
发布方称 Grok 4.7 在与 Grok 4.6 相同价格和速度下有显著提升。
所属事件:Grok-4.7 内部评测 22 项任务排第三 成本不足 5 美元(2 条相关)→
「模型」频道最新
- 曝 Grok 4.7 同价发布:CursorBench 46.3%,双用途风险提示拦截率 96.7% — petrusenko_max · 2026-09-22
- Reliquary-4B 发布:全网矿工贡献 rollout 的去中心化 RL 训练数学代码模型 — const_reborn · 2026-09-22
- REAP 剪枝 Qwen3.8-Flash-Next MLX 版实测:三个档位怎么选 — MensaProdigy · 2026-09-22
- 开发者自述:DeepSeek V4 NVFP4 优化后 192GB 只剩 2GB 余量 — HankYeomans · 2026-09-22
- OpenAI 研究员吐槽:语音模型为何还做不到真人式实时对话 — willdepue · 2026-09-22
- Ling-3.0-flash-VL 实测:截图生成网页代码仅 17 秒 — _jaydeepkarale · 2026-09-22