Multimodal AI Combined with Blender and Hunyuan 3D Enables Efficient 3D Modeling
多模态AI模型正逐渐成为生成3D资产的最佳路径,通过将大语言模型与专业3D软件结合,AI现已能辅助搭建出几乎任何3D模型。这套由创作者摸索出的新工作流打通了从图像处理到模型生成的全链路,展现出极高的实用性。
已确认
创作者们经过两周的摸索,确认了一套由多款AI工具串联的3D建模工作流,并成功制作出高达模型等复杂资产。该具体流程已被拆解为以下核心步骤:
1. **图像预处理**:先用Gemini将模型图片整理成干净的正面参考图。
2. **视角补全**:将正面图喂给ChatGPT,让其补出背面视图和45度左前方视图。
3. **图转3D**:将上述多视角图片导入腾讯混元3D的Image to 3D多图模式,导出GLB格式文件。
4. **重拓扑减面**:在混元3D的3D Studio中,使用拓扑工具对GLB文件进行处理,选择“高”档位以在保留细节的同时大幅减面。
5. **Blender精修**:最后通过接入MCP的Blender对模型进行进一步处理与组合。
为什么重要
正如@giffmana所指出的,两年前业界根本想不到多模态语言模型会把Blender作为生成3D资产的最佳路径。这一工作流的出现标志着AI 3D生成从单一模型预测走向了多模型协同(Gemini、ChatGPT、混元3D)与专业工具链深度结合的新阶段,大幅降低了复杂3D资产的创作门槛。
2026-07-25 ~ 2026-07-27 · 7 related posts
Primary sources
- [source] Multimodal models are now using Blender to generate 3D assets — giffmana · 2026-07-25
- [source] Blender + MCP workflow shows AI can help build almost any 3D model — FinanceYF5 · 2026-07-27
- Gemini front views plus ChatGPT angles form the same 3D modeling pipeline — FinanceYF5 · 2026-07-27
- [source] Gemini plus ChatGPT and Blender MCP can now build 3D models from one photo — FinanceYF5 · 2026-07-27
- ChatGPT helps generate missing views for Hunyuan 3D’s multi-image pipeline — FinanceYF5 · 2026-07-27
- Hunyuan 3D’s image-to-3D flow uses multi-view inputs and exports GLB — FinanceYF5 · 2026-07-27
- Tencent Hunyuan 3D retopology keeps detail while cutting mesh count — FinanceYF5 · 2026-07-27