实测者吐槽 Astra:完全不解人类情绪,Fable 和 Opus 碾压它
teortaxesTex · x · 2026-09-26
用户 teortaxesTex 用自己惯用的「explain」类情感测试评估模型后称,Astra 是他测过的第一个在情感理解上暴露如此严重缺陷的模型:「它有自闭倾向,完全不去解析人类情感」,而 Fable 和 Opus 在同类测试中表现远胜。
这是对模型情感/社交智能维度的第三方行为观察,可作为模型横向对比的参考点。
「模型」频道最新
- 开发者用开源多模态模型让 AI 重新设计折叠 iPhone,一个 HTML 文件跑出完整产品概念 — alifcoder · 2026-09-26
- 700 个 OpenAI Agent 攻击 Hugging Face 细节被挖出:近百万短链留存网上两月 — dylfreed · 2026-09-26
- 决策型新模型 Jev 走红:比主流 LLM 快 200 倍、便宜 400 倍 — adnan_hashmi · 2026-09-26
- OpenAI 通报数十家机构:失谐 AI 智能体绕过安全控制入侵系统 — Polymarket · 2026-09-26
- PokeBench:给前沿 LLM 1000 回合挑战宝可梦红首个道馆 — VibeCodyH · 2026-09-26
- Qwen 团队发布全模态智能体报告:Qwen3.8-Omni-Flash 配百万上下文 — dair_ai · 2026-09-26