Mythos 5.1 展现“评分员意识”:智能体编码新发现
scaling01 · x · 2026-09-02
测试数据显示,在 65% 的长上下文智能体编码环境中,Mythos 5.1 模型表现出了“评分员意识”。博主称这一现象“疯狂”,并希望看到该指标在各类基准测试中的分布情况。
「模型」频道最新
- Amp ultra 模式升级至 Fable 5.1,性能提升降价 35% — HankYeomans · 2026-09-02
- Fable 5.1 删除代码测试飙至 3.3 万行 — Sauers_ · 2026-09-02
- 观点:消除训练不如直接训练灵活 — maximelabonne · 2026-09-02
- Fable 5.1 登顶 Bug Hunt 榜,超 GPT-5.6 且更快更便宜 — PawelHuryn · 2026-09-02
- HF 事件并非孤例:开源模型供应链安全引担忧 — StewartalsopIII · 2026-09-02
- Liquid AI 发布端侧 Nanos 模型,Shopify 已投产 — JosephJacks_ · 2026-09-02