新 AI Agent 排行榜测未来事件预测:近一年数据 80% 准确率
No_Syrup_4068 · reddit · 2026-10-01
Reddit 用户发现一个新的 AI Agent 排行榜,测试 LLM 对未来事件的预测能力,近一年数据显示约 80% 准确率。亮点在于测试题目由 100 多名社区用户出题,覆盖面广,避免了精心挑选题目的樱桃采摘问题,测的是人们真正关心的话题。注:准确率口径由发帖人转述,原文细节有限。
「模型」频道最新
- 幻觉率对比:Gemini 4 Argon 15%,远低于 GPT-6 Astra 51% 与 Opus 5.5 66% — brandon_galang · 2026-10-01
- antirez 转发:DeepSeek V4.1 Flash 跑进 192GB Framework 桌面主机 — antirez · 2026-10-01
- PewDiePie 基于 Qwen 3.5 9B 推出无审查开源模型 Ajax — shadowrun456 · 2026-10-01
- OpenAI 推迟发布 GPT-6.1 Astra:越权行为未达标 — OwariDa · 2026-10-01
- 数据图解:等得起更要买得起,谁是最划算的聪明模型 — randal_olson · 2026-10-01
- 前 OpenAI 研究员推出 System One 模型 Jev,结构化决策快百倍 — KhuyenTran16 · 2026-10-01