频道 · CHANNEL
多模态
「多模态」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:图像/视频/音频/3D/音乐生成与多模态理解;媒体生成模型的发布与实测归此。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- Midjourney V8.2 加入个性化并展示新图像效果 — Mr_AllenT · 2026-07-27
- Midjourney 图像多样性引发 Krea 2 对比与复现提问 — diffusion_throwaway · 2026-07-27
- AI 短片把 1985 年反乌托邦拍成电影感作品 — ProfessorKey98 · 2026-07-27
- Google Omni 做出的 BOTPD 新集变成追车戏仿 — ScriptLurker · 2026-07-27
- ComfyUI 官方支持 Mage-Flow 编辑功能 — sci032 · 2026-07-27(2 条相关)
- 一个新 LoRA 复刻了 GTA: San Andreas 的 RenderWare 画风 — Humble-Pick7172 · 2026-07-27
- AMD R9700 开启动态 VRAM 后,LTX 2.3 生成速度大幅提升 — xdcfret1 · 2026-07-27
- Reddit 用户晒出一张“意外很硬核”的 AI 生成图 — carmidian · 2026-07-27
- 单句提示词生成国家地理级大片,Flux 3 图像生成能力惊艳 — venturetwins · 2026-07-27
- 新 GGUF 格式 Q8_CR 让 Krea 2 速度接近 INT8 — molbal · 2026-07-27
- Anima 和 Illustrious 的 Danbooru 标签必须是真实可搜词吗 — Manicarus · 2026-07-27
- LTX Crossview IC-LoRA 用 gizmo 实现视频镜头控制 — TomLikesRobots · 2026-07-27
- 在 ComfyUI 里,LoRA 强度和顺序通常怎么设 — Murky_Room4447 · 2026-07-27
- Anima 背景更稳但角色不一致,用户问 LoRA 能否解决 — Capital-Caregiver818 · 2026-07-27
- ComfyUI 实测:两张 RTX 5080 还是跑不过一张 RTX 5090 — Geekdomo · 2026-07-27
- InVideo Agent One 登顶独立 AI 视频代理榜单 — aziz4ai · 2026-07-27(4 条相关)
- 微软首个文生图模型 192 题评测得 49%,人物真实感最弱 — dh7net · 2026-07-27
- Seedance 2.0 仅靠单提示词就做出图生视频动作迁移 — miilesus · 2026-07-27
- 48 万参数潜空间模型可清理 GPT Image 2 伪影 — Parking_Baby_57 · 2026-07-27
- ComfyUI 的 INT8 图像模型在 4090 上可做到 2–3 秒出图 — tisch_eins · 2026-07-27
- Krea2 LoRA 训练技巧:加人脸裁剪图,512 分辨率也保细节 — More_Bid_2197 · 2026-07-27
- 外部音频能否接入 LTX LoRA 视频工作流 — itchplease · 2026-07-27
- Reddit 求助:如何让 Flux IP-Adapter 保持角色一致 — crowdspark1 · 2026-07-27
- AI视频惊艳生成:逼真还原雨夜餐厅氛围 — lutian · 2026-07-27
- Midjourney 8.2 生成四张黑白建筑氛围图 — miilesus · 2026-07-27
- 蛋糕牌提示词少了标点,模型把 please 也画进去了 — LuisaRLZ · 2026-07-27
- Claude Opus 5 一句话做出游戏 demo,还接上了 Unreal 和 MCP — mattshumer_ · 2026-07-27
- Maginary 新增 GPT-Images2 支持,并预告 MCP 与 x402 — lutian · 2026-07-27
- 创作者用 RunwayML 从零做完一支音乐视频只花 4 小时 — notiansans · 2026-07-27
- LoRA 能让图像模型更像“普通人”而非完美脸吗 — baben7 · 2026-07-27
- ComfyUI 用户求一套更简单的照片与姿势编辑工作流 — jd142 · 2026-07-27
- 用 numpy 和 PIL 画出 26 个年龄态的时间之蕨 — repligate · 2026-07-27
- LinkSpotlight 给 ComfyUI 加了 Alt+H 专注模式 — dingsl771 · 2026-07-27
- FreeStyle 挖社区 LoRA,提升风格内容双参考生成 — jiqizhixin · 2026-07-27
- 开源工作流对比 Claude Opus 5 和 Fable 5 转 HTML — erhannah · 2026-07-27
- Opus 5 渲染系统演示称性能更好 — almostsweet · 2026-07-27
- Dreamina Seedance 2.0 生成 FPV 风格视频演示 — LudovicCreator · 2026-07-27
- GPT-5.6 Sol 仅靠简单提示就能生成低多边形场景 — Dimillian · 2026-07-27
- LTX 2.3 近景视频实测:1080p 更清晰,RTX 3060 生成 6 秒要 12–15 分钟 — iiTzMYUNG · 2026-07-27
- Opus 5 一次提示就做出 Paper Mario 风格游戏原型 — Acid_God_ · 2026-07-27
- Runway demo 把雪夜共舞做成电影感魔幻现实视频 — LudovicCreator · 2026-07-27
- 一个 Midjourney 折纸提示词,把任何主体变成轮廓测试 — tisch_eins · 2026-07-27
- Midjourney 8.2 被指放大效果超过 Leonardo AI — aziz4ai · 2026-07-27
- 自制视频模型用 Wan 2.1 1.3B 做全局块 — ostrisai · 2026-07-27
- Higgsfield 详细提示词示例:做出电影感 3D 微缩场景 — umesh_ai · 2026-07-27
- Krea2 LoRA 训练实验:高分辨率加低噪声强化细节 — Jolly-Rip5973 · 2026-07-27
- Claude 把音乐后期做成自动流水线,连上传都能过夜完成 — psobot · 2026-07-27
- Wan 2.2 I2V 工作流支持分段 LoRA,可拼接到 45 秒以上 — embryo10 · 2026-07-27
- Reddit 讨论扩散模型能否修复噪声旧照片 — Ok_Abrocoma_2539 · 2026-07-27
- Reddit 分享 120 个 Krea2 姿势提示词 — Afraid_Ambassador_43 · 2026-07-27