Apertus 1.5 是支持图像和语音的欧洲 70B 基座模型
AxSaucedo · x · 2026-07-27
欧洲 70B 基座模型 Apertus 1.5 增加原生图像与语音能力
这条帖称,ETH Zurich、EPFL 和瑞士国家科学基金会发布了 Apertus 1.5,这是一个来自欧洲的 70B 基座模型,并且支持原生图像理解和语音处理。
配图还给出了它在 33 个图像基准上的视觉表现对比:
- Apertus 1.5 8B:55.0
- Apertus 1.5 70B:53.6
- Qwen 3 VL 8B:61.7
- Gemma 4 12B:57.1
- Molmo 2 8B:57.1
- Gemma 3 27B:53.1
- Pixtral 12B:50.6
- EuroVLM 9B:46.4
帖子整体是在强调:欧洲正在密集推出自己的基础模型,而 Apertus 1.5 是其中一个带多模态能力的重要节点。
「多模态」频道最新
- 用户给 Opus 5.5 三小时预算,模型自主拍出九龙超现实恐怖短片 — rainbird · 2026-09-23
- AI 生图博主分享高速公路场景 prompt,自晒连续出图效果 — techhalla · 2026-09-23
- Opus 5.5 生成 2000 年代风格火柴人格斗动画 — JasonBotterill · 2026-09-23
- 《平常》:AI 生成九龙城寨题材恐怖短片引发关注 — rainbird · 2026-09-23
- 截图角色配一条提示词即可生成同款角色 — iamaliveix · 2026-09-23
- Google 开源 Noto 3D:2D 贴纸变立体,才发现狗狗只有三条腿 — GoogleDesign · 2026-09-23