预测市场实测:Liquid AI 的 D1 分类器 12 类中赢 9 类
JosephJacks_ · x · 2026-10-02
Utkarsh Ruhela 基于 Philip Tetlock 的良好判断项目(GJP)历史预测题集做了一项对比测试:让 typesafeai 的 Jev 与 Liquid AI 的 D1 两款分类器对场景中每个结果给出概率,再与真实结果比较量化表现。结果显示 Liquid AI 的 D1 在 12 个类别中拿下 9 个胜出。作者认为这对寻找新量化手段做预测市场交易的人是鼓舞人心的结果,但同时声明不鼓励将其用于赌博。
「模型」频道最新
- ChatGPT Pro 500 档英国定价曝光:£445 约合 589 美元 — koltregaskes · 2026-10-02
- 开源编码 Agent Z-Engine:用 System 1 模型接管小决策 — arshadbarves · 2026-10-02
- 测试 8 个顶级模型:长周期经营任务 AI 仅达人类 27.3% 水平 — rohanpaul_ai · 2026-10-02
- ChatGPT 付费账号明早 10 点全球用量重置,GPT-6.1 恢复正常速度 — Angaisb_ · 2026-10-02
- 「Google 不会查证」背后:AI Overview 总结是否经过事实核查? — daluoseo · 2026-10-02
- 开发者:智能与意识是人投射给模型的,不在系统里 — gerardsans · 2026-10-02