上海AI实验室发布 Intern-S2-397B,vLLM 零日支持
vllm_project · x · 2026-09-14
上海 AI 实验室发布旗舰多模态基础模型 Intern-S2-397B:MoE 架构,总参数 397B、激活 17B、512 专家,基于 Qwen3.5 混合线性/全注意力架构,262K 上下文,内置共享权重 MTP 头支持投机解码。定位长程科学研究与科学智能体,兼顾知识、推理、编码与多模态(支持图像/视频输入)。
关键成绩:
- 通用能力位居开源模型第一梯队
- Biology-Instructions、Mol-Instructions 等科学任务表现突出
- IMO-Proof 与 AdvancedMathBench 达开源领先,号称比肩 Gemini 3.1 Pro 等顶级闭源模型
部署:vLLM 提供 Day-0 支持(需 vLLM ≥ 0.22.1),官方 FP8 权重可在 8×H100/H200 上以 TP=8 运行;BF16 建议 8×H200;需 trust-remote-code(自定义 InternS1Tokenizer),并禁用 DeepGEMM、选用 FlashInfer TRTLLM MoE 后端。时序推理暂仅 LMDeploy 支持。
所属事件:上海AI实验室开源Intern-S2-397B,主打多模态与Agent能力(3 条相关)→
「Infra」频道最新
- llama.cpp 合入 Maple 20B-A1B 三值 MoE,CPU 低显存跑新模型 — jacek2023 · 2026-09-14
- Claude 用量加成取消,「算力大紧缺」或已开始 — jacob_posel · 2026-09-14
- 八万亿美元数据中心豪赌遭工会抵制:暂停新建直到工人权益受保护 — nordicinst · 2026-09-14
- SK 海力士完成 HBM4 内部认证,HBM 进入定制基底裸片竞争时代 — blaizedsouza · 2026-09-14
- 一个架构改动让 KV 缓存缩小 8 倍:GQA 原理与 Llama 3 实例拆解 — blaizedsouza · 2026-09-14
- HBM 系统架构全景:从 DDR 演化到 GDDR7、PIM 与 HBF 等替代路线 — blaizedsouza · 2026-09-14