QuixiAI 预告一款覆盖四模态的小型高速 embedding 模型
QuixiAI · x · 2026-07-21
QuixiAI 透露下一个项目会是 quixi-embed:一个覆盖图像、视频、音频、文本的 omni embedding 模型。
他强调这个模型会做得更小、更快,并延续自己那套自定义优化 kernel 的处理方式。回复里提到测试模型是 embeddinggemma-300M-qat-q40-GGUF、上下文 2k,但主信息还是这个即将推出的多模态 embedding 项目。
「多模态」频道最新
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 手绘手办丢进 Seedance,效果像真的“活过来” — cocktailpeanut · 2026-07-22
- 一个 AI agent 做出的沼泽乡村 MV 在 Reddit 上走红 — LazyKaleidoscope4696 · 2026-07-22
- 实测 Qwen 3 图像生成:地图边界随提问视角变化,自带中文标签 — NirantK · 2026-07-22
- 独立开发者把对着屏幕吐槽,做成了本地 MCP 报 bug 工具 — phdptsd · 2026-07-22
- Google 演示称 Gemma 4 可在 6 秒内识别车损视频 — soumitrashukla9 · 2026-07-22