语音 AI 的表现力不该是设置项,而应随对话语境变化
deepgramscott · x · 2026-08-18
Deepgram 的 Scott 发帖谈语音 AI 设计:同一句 "Sure." 在不同语境下可以表示同意、不耐烦、怀疑或让对方闭嘴,词义几乎完全由上下文决定。因此语音助手的情感表现力不应是一个固定风格参数,而应是会话上下文的产物——用户已烦躁五分钟,下一句回应就不该突然轻快;问题刚被解决,声音也应有不同质感。
「多模态」频道最新
- Equilibrium Forcing:让视频生成器按样本自适应推理预算 — du_yilun · 2026-08-19
- Tripo P2.0 预览版发布,支持原生四边形拓扑 — majidmanzarpour · 2026-08-19
- 开源单文件视频剪辑工具:专为 MiniMax H3 Ref2V 输入优化 — bstr3k · 2026-08-19
- 实时生成视频 Helios:不再追求画质,转向效率与交互形态变革 — AI Engineer · 2026-08-19
- MiniMax H3 视频生成实测,末帧用 Krea 2 优化 — takayatodoroki · 2026-08-19
- MiniMax H3 视频生成提速实战:5070Ti 10分钟 — Tight_Commercial7 · 2026-08-19