StarChild 1 同时生成像素和音频
nathanbenaich · x · 2026-07-20
@odyssey 发布了 **StarChild 1**,主打一个新的多模态世界模型:可以**同时生成像素和音频**。 这条帖子的重点不在细节参数,而在于它把模型定位成**联合生成视听内容**的世界模型,而不是单独做图像/视频或音频。
「多模态」频道最新
- Hugging Face 热门模型 Diamond-1.0 主打音频到音频增强 — nineninesix · 2026-07-21
- DiffGI 用可微几何图像提升薄壳 3D 生成质量 — clovir21 · 2026-07-21
- 创作者称用 Adobe Firefly AI Assistant 完成整支短片导演 — LudovicCreator · 2026-07-21
- Reddit 实测:Krea 2 Turbo 用绕过 LoRA 找回表情能力 — YentaMagenta · 2026-07-21
- Suno v5.5、Reason Studios 和 Grok Imagine 拼出 AI 音乐梗作 — Kyrannio · 2026-07-21
- AI 动漫创作被拆成可复用的提示词工作流 — Aiden_Tech_Ai · 2026-07-21