Luna在7/8领域胜出,DeepSeek仅守住查询配置
zainhas · x · 2026-08-07
zainhas对比了Luna和DeepSeek在不同任务类型上的表现:Luna在7/8个领域胜出,在程序分析(69-33)、并发(70-38)、运行时内部(86-59)等难题上领先约30分。DeepSeek仅在查询与配置(78-70)上占优,这类任务模式化、遵循惯例。
所属事件:Luna综合能力领先,DeepSeek失败时破坏率更低(2 条相关)→
「编程与Agent」频道最新
- CAS:为 Claude Code 打造的多智能体编码工厂 — tom_doerr · 2026-08-07
- Claude Code 更新:支持自托管环境与跨会话通信 — ashwin-ant · 2026-08-07
- Deep Agents v0.7 发布:极简中间件架构与本地评估 — hwchase17 · 2026-08-07
- Claude Skills大师课:从提示词到完整仓库的实战指南 — aakashgupta · 2026-08-07
- Cloudflare 发布 Kitesurf:专为 AI 智能体打造的无头浏览器 — dinasaur_404 · 2026-08-07
- Stripe 招兵买马:为 AI 智能体打造自主软件购买工具 — jeff_weinstein · 2026-08-07