Palantir 称 Nvidia Nemotron Ultra 在客户任务上优于前沿模型
eliano · x · 2026-08-04
Palantir 的 Shyam Sankar 说,他们把 Nvidia 的 Nemotron Ultra 接入后,只用了 24 小时、没有做后训练,就在客户真实任务上表现得“比前沿模型更好”。
- 他认为问题不在模型本身,而在于基准测试衡量的任务与客户要解决的问题不一致。
- 这条转述的核心结论是:如果看错评测指标,模型能力可能被严重低估。
所属事件:Palantir 称英伟达模型24小时跑赢前沿大模型(3 条相关)→
「模型」频道最新
- 曝 OpenAI 内测下一代 GPT-6 Sol,Astra 发布数周后再上新 — koltregaskes · 2026-09-06
- 「SVG、Web 开发、办公全被解决」:开发者呼吁急需新基准测试 — flavioAd · 2026-09-06
- 美模型安全护栏太紧,Hugging Face 网络防御被迫转向中国模型 — victor_explore · 2026-09-06
- 开发者吐槽 OpenAI Astra 编码爱加多余注释,与旧版 ChatGPT 风格不同 — cnakazawa · 2026-09-06
- GPT Astra 一句话生成 SDF 3D 场景,质疑者称靠蛮力不泛化 — teortaxesTex · 2026-09-06
- Reddit 用户质疑 ChatGPT 页面故意阻止保存对话为 PDF — TheConceptBoy · 2026-09-06