Sakana Namazu 进入医疗圈:日本医师资格考试正解率 96.4%
SakanaAILabs · x · 2026-10-09
Sakana AI 宣布其日本特化 LLM「Sakana Namazu」被医疗 AI 公司アイリス(iris)的医师循证检索工具 Evidence Finder 采用。该工具针对医师提问,从 PubMed 等数据库检索文献并生成带引用来源的回答,还内置自动验证引用文献真实性的 Verify 功能;Namazu 负责文献的比较、整合与回答生成。
- 评测成绩:基于 Namazu 的评估模型在第 120 回日本医师国家试验中取得 96.4% 正解率,アイリス称这是经产省 GENIAC 指定的国产基础模型中公开可比的最高分(截至 2026 年 9 月 1 日)。
- 技术路线:Namazu 用 Sakana 自研后训练技术解决追加日语训练常见的灾难性遗忘问题,在保持基座模型数学推理、通用知识与编码能力的同时,强化日语指令遵循、翻译与日本本土业务语境适配。
- 规划:Sakana 表示目标不止日语能力,而是让全球优秀开源模型能在日本可用,并推进推理在日本国内闭环的基础设施。
「模型」频道最新
- Chollet:远迁移在人类身上无证据,LRM 可能同样如此 — burny_tech · 2026-10-09
- Google AI Overviews 搜梗图自我误导,用户吐槽又翻车 — prajdabre · 2026-10-09
- InfiLoop:循环注意力残差让7M小模型跑2万步推理,数独97.9% — Pengxiang Li · 2026-10-09
- ChatGPT 200 美元套餐额度降至 10x,但每周免费重置相当于双倍 — vuonghtt · 2026-10-09
- Grokipedia 实时编辑页上线,可围观 AI 百科 119 万条修改变更 — XFreeze · 2026-10-09
- 玩家与 Grok 玩词联想游戏,追问后其承认「不存数据」是预设回答 — jetopia · 2026-10-09