像艺术评论家一样评测 AI:Grok 4.6 占星能力实测
karinanguyen · x · 2026-08-13
作者获得 Grok 4.6 早期体验后,采用类似艺术评论的视角,将其与 Grok 4.5、Claude Opus 5 和 GPT-5.6-sol 进行了对比测试。测试使用 114 个提示词,涵盖哲学、自我认知、幽默、诗歌和占星学等没有标准答案的领域。作者特别关注模型在处理模糊问题和性格怪癖等方面的表现,并邀请了专业占星师对模型的占星回答进行独立评估。
「模型」频道最新
- Grok 4.6 发布引争议,被指缺乏详细模型卡与安全测试 — Miles_Brundage · 2026-08-13
- 英伟达祝贺 xAI 发布 Grok 4.6:基于 GB300 训练 — elonmusk · 2026-08-13
- Grok 4.6 智能指数达 61,跻身大模型第一梯队 — elonmusk · 2026-08-13
- Upstage Solar Pro 4 评测:智商居前但速度过慢 — ArtificialAnlys · 2026-08-13
- Solar Pro 4 幻觉率下降真相:靠拒答而非知识增长 — ArtificialAnlys · 2026-08-13
- 韩国 Upstage 发布 Solar Pro 4,智能体能力大幅提升 — ArtificialAnlys · 2026-08-13