FT 称 AI 聊天机器人金融问答大多出错,Mollick 质疑其方法论
emollick · x · 2026-09-20
《金融时报》报道称 AI 聊天机器人对金融问题的回答「大多数时候是错的」,但 Ethan Mollick 深入查看后提出质疑:
- 报告出自一家销售竞品 AI 金融服务产品的公司,存在利益关联。
- 报告信息公开有限,样本问题很少,难以评判其准确性。
- 这与其他近期显示 AI 在财务建议上表现良好的研究相矛盾。
他还在 GPT-6 Pro、Haiku、Saturn 等模型对英国税法问题的不同回答之间寻求专业判断,呼吁熟悉英国税法者辨析谁对谁错。
所属事件:FT 称 AI 金融问答大多出错,Mollick 质疑方法论(3 条相关)→
「模型」频道最新
- DeepSeek-V4.1-Flash 去审查网安版模型登上 Hugging Face 热榜 — drowzeys · 2026-09-20
- 自称 ChatGPT 联合发明者发布新模型 Jev:宣称快 20-200 倍、便宜 40-400 倍 — npinto · 2026-09-20
- TypeSafe 推出「System One」决策模型Jev:只做判断不生成 — ThePromptIndex · 2026-09-20
- Grok Voice Transcribe 2.0 发布:短句 WER 从 20.6% 降至 6.8% — nima_owji · 2026-09-20
- FT 调查:AI 聊天机器人回答金融问题多数时候是错的 — SatelliteNetSec · 2026-09-20
- 实测 Jev:数字母都只给概率,显然的问题也会答错 — eptwts · 2026-09-20