benchmarks 之外的诉求:用户想要一个能聊一整天的日常主力模型
Bobbie_Sacamano · reddit · 2026-09-20
一位以研究、长文写作、新闻追踪和日常对话为主要用途的用户认为,跑分和编码对比无法衡量一类真实需求:一个能全天候使用、可以成为「默认思考场所」的通用模型。
- 他认为最讨喜的是早期 Claude Opus 和 Fable 5.1:对话有人味、能建立延续感,但 Fable 的定价和额度更适合精打细算而非日用。
- ChatGPT 的优势相反:记忆、联网研究、文件、语音、定时任务等产品层体验让人想把所有事都放在一个地方,但模型本身缺乏「想和它说话」的吸引力。
- 他把希望押在 GPT-6 Sol 和下一代 Opus 上:前者若能把 Astra 级智能放进宽裕额度,后者若能继承 Fable 的对话感并给到订阅级用量,都可能终结他的多模型切换。
他的理想模型 = Fable 5.1 的对话质感 + 前沿推理智能 + 不用计较 token 的额度 + ChatGPT 式的工具与持久记忆。
「模型」频道最新
- 用户怒斥 ChatGPT「持续变糟」:网页版项目功能被削疑似逼用户转投 Codex — progressofprogress · 2026-09-20
- 花 $187 买的 ChatGPT Pro 被无故降级,83% 额度没用就掉到 Free — lookintheheart · 2026-09-20
- 机械臂实测:Jev 27 秒完成抓取任务,比 GPT-6 Astra 快 2.6 倍 — multiply_matrix · 2026-09-20
- 爆料称 Anthropic 暗测 Opus 5.5,代号 claude-wafer-eap,或于周二发布 — airesearch12 · 2026-09-20
- HN 热帖:聊天式大模型复刻了通灵师骗术的核心机制 — petrusenko_max · 2026-09-20
- 实测 7 个开源 Jev 风格模型,附 JevBench 基准与逐个演示 — Sam Witteveen · 2026-09-20