腾讯混元Hy3本地物理模拟接近Gemini3.5水平
rohanpaul_ai · x · 2026-07-07
在本地运行LLM的桌面应用atomic.chat上的一项测试中,让多个模型生成保龄球、冰球、台球等物理模拟,腾讯新发布的混元Hy3以约35倍更低的成本达到接近Gemini 3.5的物理质量。测试难点在于碰撞时序、动量传递、摩擦与可信散射等因果物理关系的保持——台球开球环节尤其会放大任何角度误差。值得注意的是DeepSeek-V4消耗token最多(50600个)。
所属事件:腾讯开源混元 Hy3 主打智能体(26 条相关)→
「模型」频道最新
- AxiomProver登顶LeanEval,末个未饱和数学形式化基准 — BenBlaiszik · 2026-09-03
- Muse Spark 1.3 把用户叫成 Judah 后又死不承认 — fragment_me · 2026-09-03
- 用户实测:Google AI Mode 对 TOFU 类查询完全不给出处引用 — gaganghotra_ · 2026-09-03
- 评测称 Fable 5.1 失败率减半:每百次仅 7 次失败、幻觉率 0.7% — ryanshrout · 2026-09-03
- Seroter 每日阅读清单:Gemini 3.8 Flash、agent 遥测与 7 种 skill 模式 — rseroter · 2026-09-03
- 爆料称 OpenAI Astra 有两个测试版,主打长时自主任务 — Ok_Display_3159 · 2026-09-03