开源工具 Story Illustrator:本地 LLM + ComfyUI 自动为小说配插图
Natrimo · reddit · 2026-09-19
作者发布了开源工具 Story Illustrator:输入故事文本,输出带插图的有声书籍格式成品,全程可本地运行、自带工作流和 LLM。
工作流程:
- 先让本地 LLM 分析故事,构建「视觉圣经」:角色设定、外貌、服装及随剧情的变化(换装、伤疤等);
- 再扫描全文,决定哪些情节节点需要配图;
- 为每个视觉节点生成 prompt 时,按剧情位置注入视觉圣经中对应的角色细节,保证角色服装状态一致;
- 支持批量调用多个 ComfyUI 工作流对比生成,可手动改 prompt 重生成;
- 最终把整篇文字与插图按位置嵌入,导出为常见电子书格式。
开源、可自带工作流和 LLM,除选择云端 API 外全部本地私有。
「多模态」频道最新
- ComfyMax 音乐视频导演工作流:AI 生成 MV 制作进行中 — DanielVeres · 2026-09-19
- Jina AI 发布 jina-ocr-v1 文档理解模型,冲上 Hugging Face 热榜 — jinaai · 2026-09-19
- Reddit 求助:能否用 Agent 自动搭建 ComfyUI 视频工作流 — Hopeful-Election-783 · 2026-09-19
- 单词提示词系列:用苏格兰词 Aefauld 生成诚意肖像 — tisch_eins · 2026-09-19
- 腾讯开源微信端到端文档解析模型 WeVisDoc,整页图直出 Markdown — xiaohu · 2026-09-19
- Awwwards-mcp:把获奖网站变成agent可读的设计参考库 — _insane7 · 2026-09-19