模型宣传口径两极:要么做套壳要么算 15 位小数,中间呢?
Benhamish-WH-Allen · reddit · 2026-09-30
Reddit 用户吐槽厂商对模型能力的宣传毫无信息量:所谓 "everyday task" 之类描述没有参考价值。他指出能力展示两极分化——Luna minimum 最多能给我做个 ComfyUI 视频生产套壳和简单 Web 应用,Astra Ultra 则能算到小数点后 15 位,中间地带完全空白。他呼吁建立某种聚合指标:什么模型被用来做了什么、花了多久、token 成本多少等,让宣传口径变成可比较的真实数据。
「模型」频道最新
- DeepSeek 向用户发放 6 元 API 赠金,登录 harness 即可领取 — teortaxesTex · 2026-09-30
- 用户爆料:OpenAI 连接 Gmail 后会自行翻查邮件且断开后仍留存 — alexcovo_eth · 2026-09-30
- 网友爆料:DeepSeek 新模型疑为华为昇腾训练 — teortaxesTex · 2026-09-30
- DeepSeek 上线用户反馈渠道:下载 harness 开关即可帮助改进模型 — teortaxesTex · 2026-09-30
- 预训练算力超 1e22 FLOPs 后可直接砍掉视觉编码器 — heghbalz · 2026-09-30
- Ollama 上线决策模型:Nimble 本地 91ms 出一次判断 — ollama · 2026-09-30