Anthropic「865K 交互」口径引质疑:一次交互到底算多少?
teortaxesTex · x · 2026-09-11
teortaxesTex 质疑 Anthropic 报告中「X exchanges observed」的统计口径:如果一次 exchange 是一条 API 请求-响应日志,按 86.5 万/天算,重度用户一天就能产生数千次,实际工作量可能只是不到 1000 人的规模;但如果是按完整对话计,结论会完全不同。这与流传的「opus 4.8 将远强于 Astra」的说法讨论相关,帖子核心是对 Anthropic 数据指标模糊性的较真。
「模型」频道最新
- 评论:DeepSeek 只发内部研究件不发产品,解释其评测落差 — teortaxesTex · 2026-09-11
- 用户反问 Claude「人类是否真实」,模型回应模拟假说 — vishalmisra · 2026-09-11
- GPT-6 级模型只会死磕目标,用对前提才能榨出价值 — daniel_mac8 · 2026-09-11
- SWE-2 被评速度价格智能综合最强,称当下世界第一模型 — silasalberti · 2026-09-11
- IFM 7B 就能做 AIME 竞赛数学,还自曝 103 条模型作弊轨迹 — rohanpaul_ai · 2026-09-11
- K2 Horizon 用 LoRA 并行解码提速 3 倍,预训练吃下 20T tokens — rohanpaul_ai · 2026-09-11