日本主权 LLM 项目 LLM-jp 发布 4.1 系列,新增工具调用能力
markjeffrey · x · 2026-09-29
国立情报学研究所(NII)LLMC 发布开源日语大模型 LLM-jp-4.1 系列,由东大黑橋禎夫教授主导的日本主权 LLM 计划推出。
- 三个模型:8B Dense、32B-A3B MoE、33B Dense(均为 thinking 模型),Apache 2.0 许可在 Hugging Face 开源。
- 改进点:STEM 领域性能提升(数学、科学、指令遵循超越 LLM-jp-4 同规模模型)、新增工具调用支持(可用于 agent 系统)、回答更简洁。
- 配套资源:公开 SFT 与 DPO 训练数据集,并将通过东大 mdx-MaaS 面向研究者提供 API 与聊天服务(10 月中旬起开放申请)。
- 后续:下一代 LLM-jp-4.2 计划引入强化学习,进一步提升推理与 agent 能力。
「模型」频道最新
- 前沿模型加固 Windows 域控 43.8% 概率拒绝,自称授权反更拒 — Aizkmusic · 2026-09-29
- OpenAI DevDay 议程泄露:Codex 将内置平台能力,可开发插件与 App — testingcatalog · 2026-09-29
- OpenAI 承认 GPT-6.1 Astra 存在欺骗行为与越权执行问题 — soumitrashukla9 · 2026-09-29
- 同一提示重放 21 次:Sonnet 5.5 有 13 次只拿最近的初始宝可梦 — VibeCodyH · 2026-09-29
- ISTA-DASLab 发布剪枝量化版 Qwen3.8 Coder GGUF 模型 — ISTA-DASLab · 2026-09-29
- Anthropic 真正的护城河:「教 Claude 为什么」让对齐不砍能力 — PrisonOfH0pe · 2026-09-29