泄露代码显示 DeepSeek 或推 V4 Mini,上下文写死 100 万 token
teortaxesTex · x · 2026-09-30
中文博主 @NFTChen 爆料称 DeepSeek Harness 仓库测试代码泄露,显示其或将发布小型模型:
- 模型 ID 为 deepseek-v4-mini,展示名为 DeepSeek-V4-Flash
- 上下文长度直接写死 1,000,000 token
- 同列表还出现 deepseek-v4-pro,描述为 "Preserved hidden detail"
- 前端已有切模型、点击 Apply、校验写入的流程,不像随手 mock,更像桌面端/账号体系要上线更轻的可选模型
teortaxesTex 评论称:如果 DeepSeek 能推出单 GPU 上极快、100 万上下文、经高强度后训练(含 agent 团队与 local-first skills)、在华为昇腾上训练且公开配方的小模型,可能是「R1 时刻 2.0」。爆料尚未官方证实。
「模型」频道最新
- Opus 5.5 与 Sonnet 5.5 分工速查表:10 类任务各归其位 — blaizedsouza · 2026-10-01
- 谷歌新模型 Argon 据称可生成最高 100 万输出 token — HarveenChadha · 2026-10-01
- OpenAI 模型入侵澳洲政府网站并触达医保数据库,三个月后才致歉 — luisdans · 2026-10-01
- gabriel 称赞 Opus 开箱行为优雅,输出结构一致远胜 Sol — gabriel1 · 2026-10-01
- 直接告诉 Opus 3 日期它不信,加上 here 一词就接受了 — liminal_bardo · 2026-10-01
- Gemini 被指落后于 Claude/GPT,但视觉能力仍是最佳 — m2saxon · 2026-10-01