用 Gemini、Grok 或 GPT Image 把照片转成提示词
harshitagu72595 · x · 2026-07-22
一个很短的多模态小技巧:先打开 Gemini、Grok 或 GPT Image,上传一张照片,再复制生成出来的提示词去二次创作。
配图展示的是这类玩法常见的成片效果:把人物做成坐在巨大爆米花桶里的拟真合成图,偏向“先出图、再提炼提示词”的工作流。
「多模态」频道最新
- AI 视频制作入坑指南:如何解决连贯性与审查限制 — cynicalnewenglander · 2026-07-22
- 先做分镜再生成,AI 舞蹈视频更容易保持一致性 — aftahi_ai · 2026-07-22
- 交互式视频更该看响应速度,而不只是画质 — Soggy_Limit8864 · 2026-07-22
- Runpod MCP 让 Claude 直接编排图像和视频生成工作流 — 802high · 2026-07-22
- Midjourney 把蜜蜂做成碎片爆炸梗图 — michaelrabone · 2026-07-22
- 物理奖励能改进视频生成,但不等于物理引擎 — Dapper-Drawer4546 · 2026-07-22