Swiss AI 发布 Apertus v1.5 开放多模态模型
jacek2023 · reddit · 2026-07-24
Swiss AI 发布了 Apertus v1.5,这是一个面向多语言、透明开放 AI 的 8B / 70B 模型家族。
- 模型支持 文本、图像、音频 输入,并输出文本
- 默认上下文长度最高可到 262,144 tokens
- 其中 8B 版本继续预训练时加入了 4T tokens 的多模态数据,70B 版本加入了 2T tokens
- 架构仍是 decoder-only transformer,使用 xIELU 激活和 AdEMAMix 优化器
- 新增了可切换的 thinking mode,强调推理和工具使用能力
- 官方还表示,后续会公开更完整的技术报告、基准测试、训练流水线和中间 checkpoint
「多模态」频道最新
- 北大开源 K12-KGraph:面向教育 LLM 的 2.36 万题基准 — PekingUniversity · 2026-07-24
- 疑似新 Opus 一次生成出高细节 voxel 寺塔 — cedric_chee · 2026-07-24
- Wan2.2 的 INT8 Convrot 在 3090Ti 上反而更慢 — Fun-Class3451 · 2026-07-24
- 有人开始用 Claude Code 直接生成 ComfyUI 工作流 — My-NameWasTaken · 2026-07-24
- 微软发布 VibeVoice-ASR-BitNet:一款多语种语音识别模型 — microsoft · 2026-07-24
- Midjourney 把清晨场景做成了杂志感人像 — tisch_eins · 2026-07-24