一张图十个分镜:Reddit 热传递归缩放式 AI 绘图提示词
NVDA808 · reddit · 2026-09-16
Reddit 用户分享了一个单 prompt 的图像生成实验:让模型一次性生成一张包含 10 个连续分镜的大图,每个分镜都必须是对上一个分镜中某个真实区域的放大解读。
提示词的核心设计:
- Panel 1:生成一个细节丰富的原创场景,包含建筑、人物、机械、纹理等大量可探索的视觉信息,但不预设后续走向。
- Panel 2–9:模型每生成一帧后需自行「检视」画面,选出最有探索价值的一个真实特征,用矩形框标注,下一帧只解读该区域,形成严格嵌套的递归缩放链。
- 避免平淡放大:明确要求每次缩放要揭示新的组织层级(如世界→建筑→物件→表面→微结构),禁止连续多帧停留在相似材质,也不能凭空捏造前帧不存在的元素。
整套 prompt 不需要用户任何中间决策,全程由模型自主完成「生成—观察—选点—放大」循环,被视为一种用提示词工程实现「视觉科学探索」的玩法。
「多模态」频道最新
- YuE2 实测:41 秒生成 2 分钟完整音视频片段 — cocktailpeanut · 2026-09-17
- 开源工具 Hypit 走红:一条命令让 Claude Code 克隆爆款视频并量产 100 个变体 — nikola_mr64990 · 2026-09-17
- 社区实测:Taomata 三步 LoRA 对比 FastH3 v2 Checkpoint — Sad_Coach_1433 · 2026-09-17
- RTX 5060 Ti 上用 2 秒分段+锚点帧拼出 11 秒 AI 动画 — Wonderful_Sample6291 · 2026-09-17
- 开发者在做可反复演化的 AI 创作工作台 DRAW,筹备 30 人内测 — hypergraphr · 2026-09-17
- 用 Codex 加开源 Hypit 复刻百万播放爆款视频全流程 — songguoxiansen · 2026-09-17