开发者吐槽 DeepSeek 新模型跑分亮眼但实对比不上宣传
bindureddy · x · 2026-09-27
开发者 Bindu Reddy 吐槽 DeepSeek 又是「刷榜之王」:其最新的 Flash 模型宣称可媲美 Fable 和 Astra,但他认为任何人实际用上两分钟就知道这个说法站不住脚。
「模型」频道最新
- 167 个模型上创意写作基准,作者开帖 AMA 谈性能与成本 — OnlyProggingForFun · 2026-09-27
- 周报:Amazon 封禁 Muse、agent 抢订餐厅,Opus 与 GPT 掀 90 分钟价格战 — njyx · 2026-09-27
- 盲测 90 组对比:具名风格参考比形容词让模型出图好 68% — maxsloef · 2026-09-27
- 评测设计细节:让模型自选风格参考并在独立调用中完成 — maxsloef · 2026-09-27
- LLM 评委对不上人类口味,作者猜这正是风格短板难修的原因 — maxsloef · 2026-09-27
- Namedrop 评测:模型给具名风格参考效果远胜形容词组 — maxsloef · 2026-09-27