实测三家语音模式:ChatGPT 与 Gemini 能听出耳语,Grok 不行
deferare · reddit · 2026-08-28
作者分别用 ChatGPT、Gemini、Grok 的语音模式测试模型能否判断自己是在耳语还是正常音量说话。
结果显示 ChatGPT 和 Gemini 都能准确识别耳语状态,而 Grok 判断失败。作者推测 Grok 的语音模式是先把语音转成文字再处理(STT),丢失了音量、语气等信息;而 ChatGPT 和 Gemini 是原生处理音频输入,因此保留了这些副语言特征。
「模型」频道最新
- 实测转向:Grok 4.6 在复杂工具调用上胜过 Gemini 3.7 Flash — brandon_galang · 2026-08-28
- 智谱 GLM 5.3 Flash 登场:多项跑分超越竞品 — jefrankle · 2026-08-28
- GLM-5.3-Flash 性能超群,更新 LLM 梯队排名 — airesearch12 · 2026-08-28
- GLM 5.3、Qwen 与 DeepSeek Flash 版本对比排行 — nijfranck · 2026-08-28
- Z.ai 全用国产芯片跑通 GLM-5.3,算力成本降超 40% — yogthos · 2026-08-28
- 为何让模型选 1-4 之间的数,它总选 3? — LChoshen · 2026-08-28