禁用中国模型怎么办?Reddit 求荐 40B 以下替代方案跑代码与长文 QA
AdRepulsive7837 · reddit · 2026-10-02
一位网友因公司规定不允许使用 Qwen/DeepSeek 等中国模型,征求本地部署的替代选择,需求有两类:
- 编程任务
- 长文档问答——例如输入 12 万 token 的完整病史后基于内容提问
候选包括 Gemma 31B、Muse Glimmer 30B、Nemotron 等。楼主也问:虽然公认 Qwen 最强,但有没有基于这些替代模型的微调版能在编程上超过 Qwen3 27B。
「模型」频道最新
- 研究者称将某领先开源模型推理效率提升 74% — airesearch12 · 2026-10-02
- MiniMax M3.1 Flash 中途加入 RSIArena 竞赛,直播实时比拼 — my_cat_can_code · 2026-10-02
- 微软 AI 发布流式转录模型 MAI-Transcribe-2 及语音合成模型 — The Decoder · 2026-10-02
- 为什么 ChatGPT 总爱答 47 和 73? — Princevora03 · 2026-10-02
- 每日简报:Grok 4.7 全面上线,Claude Code 推出 Mods 扩展机制 — testingcatalog · 2026-10-02
- Screen Studio 自训 5000 个假 SwiftUI 应用练出屏幕录制专用超分模型 — CurieuxExplorer · 2026-10-02