MiniMax 本地提示词生成:突破图文同时读取限制

Mediocre-Toe3212 · reddit · 2026-08-09

Reddit 用户讨论了如何使用本地模型(如 Qwen 或 Gemma)为 MiniMax 视频生成构建提示词生成器。作者成功实现了让模型分别读取图片或视频,但发现目前的节点无法同时处理两者。

为了绕过这一限制,作者采用了一种“黑客”手段:将视频拆分成帧,并欺骗系统,将第一帧作为静态图片源描述,随后的帧作为视频流输入。Claude 也证实,当前架构下确实没有节点能原生同时读取图文与视频。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →