用微表情标签与上下文提示,给语音模型注入情绪
a-ijoe · reddit · 2026-09-08
Reddit 用户分享自己探索语音对话模型情绪表达的经验:模型能理解大量在说话过程中叠加的标签,不同情绪需要不同程度的提示,有些情绪只能靠括号内注释或句尾标记触发。作者还用这些技巧制作了一部短片展示效果,并表示如果有人感兴趣会在 X/Reddit 上出教程。
「多模态」频道最新
- ECCV 2026 报告:拆解多模态基础模型的内部表征 — abursuc · 2026-09-08
- fal 推出 H3 Max 系列实时 1080p 视频生成,5 秒视频 5 秒内出片 — isidentical · 2026-09-08
- Minimax H3 实测:两步工作流比单步更快且画质不掉 — Hot_Store_5699 · 2026-09-08
- Minimax H3 实测:两步工作流比单步更快且画质不掉 — Hot_Store_5699 · 2026-09-08
- Higgsfield 联手 Astra 主打一个 Agent 跑通广告后期全流程 — _AustinCalvert_ · 2026-09-08
- 用户实测 Grok Bot:一句话搞定 Suno 歌曲批量上传 YouTube — TJLarkin23 · 2026-09-08