1小时155M tokens只花了1.8美元,V4.1生成质量仍堪忧
teortaxesTex · x · 2026-09-09
网友分享一次典型的 V4.1 长会话体验:耗时约 1 小时,其中约 30M token 的生成量,共 419 步、消耗 1.55 亿 token,最终输出不足 0.5M,花费约 1.8 美元。
从视觉角度看产出"像一坨",但作者称 Astra(指参考的模型/对象)对其中的数学能力(mafs)印象不错,说明该模型在数学推理上尚可、生成质量仍需改进。
「模型」频道最新
- APEX-Agents 1.1 更新基准:Claude Fable 5.1 以 68.6% 居首 — amaarora · 2026-09-09
- 评论:前沿模型订阅必然「缩水通胀」,逼你升级到 API 付费 — StewartalsopIII · 2026-09-09
- 用户实测:高峰定价翻倍后,252M 缓存 token 一天只花 $0.75 — teortaxesTex · 2026-09-09
- 实测对比:Astra 长线程表现明显逊于 Sol,易跑偏失稳 — jdjohnson · 2026-09-09
- VC communism 时代落幕,前沿模型开始配给制,VC 求选模型心法 — StewartalsopIII · 2026-09-09
- "数据标注已死"遭质疑:cherry-pick 演示≠长尾能力 — chris_j_paxton · 2026-09-09