Luna模型能力超越DeepSeek,但agentic场景成本仍偏高
teortaxesTex · x · 2026-07-31
推文指出,Luna 模型在性能上显著超越了 DeepSeek V4-Pro。然而,在智能体场景下,Luna 的 token 成本并不占优:其缓存读取成本仍高出 5.5 倍,且存在长序列惩罚和额外的缓存写入费用。作者认为 DeepSeek V4 亟需改进。
所属事件:GPT-5.6 Luna降价引爆性价比,推理成本四个月降十三倍(8 条相关)→
「模型」频道最新
- 疑似DeepSeek-V4思维链曝光:被指像中文直译 — teortaxesTex · 2026-07-31
- Luna 输入虽廉,长文本智能体任务仍难撼 DeepSeek 缓存经济 — teortaxesTex · 2026-07-31
- 用户吐槽 Hive AI:假图未被识别,无声片段却有假声音 — henkvaness · 2026-07-31
- DeepSWE 编码智能体榜单:Claude Opus 与 GPT-5.6 并驾齐驱 — tristanbob · 2026-07-31
- Hive AI 检测失误:假乌鸦未被识别,无声片段却检出 36% 音乐 — henkvaness · 2026-07-31
- 谷歌回应AI造假质疑:Gemini生成图像已全面嵌入SynthID水印 — henkvaness · 2026-07-31