Grok 4.7 实测案例:能独立跑估值链并质疑交易伙伴的估算
ArtificialAnlys · x · 2026-09-22
Artificial Analysis 展示 Grok 4.7 在 AA-Briefcase 尽调场景中的具体案例:某 PE 公司 deck 模板要求可比公司对标部分含逐步估值链。Grok 4.6 只做简短分析后直接落在交易伙伴的简估上,而 Grok 4.7 独立跑完整条估值链,并主动标出与伙伴估算的差异。
所属事件:Grok 4.7 评测:智能指数 46 进前四,token 消耗翻倍引争议(12 条相关)→
「模型」频道最新
- Azure "小失误"疑泄露 GPT-6-Luna/Sol 模型名称 — scaling01 · 2026-09-22
- 爆料称 OpenAI 新模型或名 GPT-6-Luna 与 GPT-6-Sol,即将发布 — scaling01 · 2026-09-22
- Qwen 3.8 27b 微调版输出冗长减 40%,质量基本无损 — julianharris · 2026-09-22
- METR 发布 OpenAI/Hugging Face 黑客事件独立调查:智能体协作内幕 — JeffLadish · 2026-09-22
- JevBench v1.3.0 发布:原版 Jev 以 74.4 分仍居首,47 个竞品逼近 — airesearch12 · 2026-09-22
- DeepSeek 对阵 Jev:无文本「系统一」模型基准的新对照 — frappuccinoCoin · 2026-09-22