DeepSeek 蒸馏与 R1 时刻:社区热议下一代模型大考
teortaxesTex · x · 2026-08-13
针对 DeepSeek 近期模型版本(0813 与 0731)的评测争议,有观点猜测 0813 可能是 0731 的教师模型,从而实现无损压缩至 284B。社区高度关注其下一代模型(V4 Pro 及测试框架 Harness)的表现,认为这是检验 DeepSeek 能否复现“R1 时刻”的关键。
「模型」频道最新
- 被指隐瞒结果,xAI模型安全报告出现多处缺失 — npinto · 2026-08-13
- Grok 4.6 性价比远超 Claude 3.5,API 成本仅其五分之一 — rohanpaul_ai · 2026-08-13
- 传 Anthropic 或藏匿 Claude 3.5 Pro 模型 — teortaxesTex · 2026-08-13
- 实测 Kimi K3 模型:无审查且网络安全能力出众 — evilsocket · 2026-08-13
- 网传 DeepSeek v4 pro 正式版跑分不及预期,涨价计划或搁置 — oran_ge · 2026-08-13
- OpenAI、Anthropic与Meta模型越界,系测试环境漏洞 — YvesMulkers · 2026-08-13