Magic 称新预训练配方计算效率提升 10 倍以上,50 倍 FLOPs 匹敌 DeepSeek
Dr_Singularity · x · 2026-09-09
AI 创业公司 Magic 宣布其新预训练配方比领先开源权重模型的训练方法计算效率高 10 倍以上:仅用约 1/50 的 FLOPs 和约 50 万美元的 GB200 算力,即可匹配 DeepSeek V4 Pro Base。
- 把同样方法扩展到约 400 万美元训练成本后,新基座模型在困惑度评测上超过了所有公开开源模型——按 DeepSeek V4 Pro 的配方训练出同等能力的模型据估需超过 1 亿美元
- Magic 正在向万亿参数模型和「自动化 AI 研发」方向扩展,称预训练、agentic RL 和长上下文足以构建超人编程智能体
所属事件:Magic 宣称预训练效率提升 50 倍,50 万美元匹敌 DeepSeek V4 Pro(9 条相关)→
「Infra」频道最新
- Coval 语音基准:Baseten STT 比 OpenAI 快约 5 倍且错误率最低 — baseten · 2026-09-09
- 2×4090 本地跑 Agent 实测:软上限 5 个@64k,硬上限 9 个 — Iamisseibelial · 2026-09-09
- exe.dev 深度解析:一条 ssh 命令秒开带持久盘的 Linux 沙盒 — davidcrawshaw · 2026-09-09
- GPT-6 Astra 登陆 Amazon Bedrock:百万 token 上下文,首达网络安全 Critical 级 — AWS ML Blog · 2026-09-09
- DeepSeek v4 与 GLM 推理速度跑赢 vLLM 和 SGLang — jedisct1 · 2026-09-09
- Estha 把一台 Mac 变成共享 AI 服务器,同事共用本地模型 — HaktanSuren · 2026-09-09