文本提示词致盲:ChatGPT 视觉识图被关键词带偏
Red-Pony · reddit · 2026-08-10
一位 Reddit 网友发现 ChatGPT 在处理图像时存在“文本提示词压倒视觉内容”的严重幻觉现象。
在测试水洗麂皮衬衫的洗水标时,如果仅问“洗标写了什么”,模型能准确识别出“机洗、不可干洗”等正确信息。然而,一旦在提示词中加入“这是一件麂皮衬衫”,模型就会产生严重幻觉,直接脑补出“不可水洗、不可烘干、仅限专业皮革清洗”等典型的麂皮护理说明,完全无视了图片上的真实文字。作为对比,Gemini 在相同测试下未受影响,给出了正确答案。
「模型」频道最新
- Qwen 3.8 Max 评测高分遭疑,用户实际办公体验未达预期 — DavidOrzc · 2026-08-10
- Grok Imagine 2.0发布,图像生成榜单跃居全球第二 — eyishazyer · 2026-08-10
- Anthropic API 严控模式遇 $ref 会输出自相矛盾结果 — Nearby_Yam286 · 2026-08-10
- ChatGPT 协助代数拓扑研究,复活冷门前沿领域 — AlexKontorovich · 2026-08-10
- 用户反馈 Claude Opus 模型出现严重偷懒行为 — AIFlow_ML · 2026-08-10
- AI评测设计领先实际训练半年,闭源模型将利用所有漏洞 — xeophon · 2026-08-10