Thinking Machines 发布 276B 模型 Inkling-Small,实现极速语音交互

MaziyarPanahi · x · 2026-07-31

Thinking Machines 发布了全新的混合专家模型 Inkling-Small(总参数量 276B,激活参数 12B)。该模型在多项基准测试中媲美甚至超越其 975B 的大版本。在实测中,将其接入 HF 的语音到语音管线,音频直接输入模型并由 faster-Qwen3TTS 生成回复,在 8x RTX Pro 6000 Blackwell 上实现了低于 500ms 的音频回传延迟。

所属事件:Thinking Machines 发布 Inkling-Small 开源模型(23 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →