Pokee-Isaac 28B模型评测曝光,单卡推理性能击败多款同量级竞品
Kyrannio · x · 2026-08-12
Pokee AI 发布了其 Pokee-Isaac 28B 模型与 Meta 最新 Muse Glimmer 30B、Qwen3.6 27B 及 Gemma 4 31B 的横向评测结果。在相同的约30B参数级别和测试环境下,Pokee-Isaac 在多项智能体基准测试中全面领先:BFCL v4 得分 70.94,τ³-bench 为 66.67,Terminal-Bench 2.1 为 65.12,MCP-Atlas 达到 74.59%。
此外,该模型具备独特的超长上下文处理能力,在 1000 万上下文的 RULER 测试中准确率达 93.3%,在 100 万 token 上下文的 MRCR v2 测试中得分为 0.5(其他模型均为 0)。该模型可部署在单张 GPU 上,进一步加剧了本地端侧前沿模型的竞争。
「模型」频道最新
- 微软新代码模型提效25%且降价75%,已上线Copilot — mustafasuleyman · 2026-08-12
- 用户反馈Grok无故拒答前沿科学公式 — Promptmethus · 2026-08-12
- Ling-3.0-flash 量化实测:MoE 架构让解码速度几乎无损 — AcanthisittaOk1699 · 2026-08-12
- FLUX 3 Video登顶全球第二,限时开放免费体验 — arena · 2026-08-12
- 研究者发现OpenAI端点输出神秘乱码,疑似Token解码异常 — jonasgeiping · 2026-08-12
- M4 Max 浏览器跑 30B 模型达 25 tok/s,自定义 WebGPU 内核立功 — xenovatech · 2026-08-12