Palantir 称 Nvidia Nemotron Ultra 在客户任务上优于前沿模型
eliano · x · 2026-08-04
Palantir 的 Shyam Sankar 说,他们把 Nvidia 的 Nemotron Ultra 接入后,只用了 24 小时、没有做后训练,就在客户真实任务上表现得“比前沿模型更好”。
- 他认为问题不在模型本身,而在于基准测试衡量的任务与客户要解决的问题不一致。
- 这条转述的核心结论是:如果看错评测指标,模型能力可能被严重低估。
「模型」频道最新
- xAI 用 Grok 4.5 升级 Grok Build,加入技能和计划模式 — elonmusk · 2026-08-04
- 自定义搜索 RL 训练,可能比“单一大模型”更有效 — shangbinfeng · 2026-08-04
- Qwen 3.8 Max 在高难度 INDUCTION 基准拿到 42% 排名第二 — DeryaTR_ · 2026-08-04
- OpenAI 招入 WebRTC 创始人,GPT-Live 语音系统也被深挖 — bookwormengr · 2026-08-04
- Code Arena WebDev 榜单:4 个中文开源模型逼近前沿 — floriandotorg · 2026-08-04
- GPT-5.6 生成邮件拼错地址,事后强行辩解被识破 — WolframRvnwlf · 2026-08-04