Sakana Namazu 助医考工具答对 96.4% 医师国家试题,创国产模型纪录
SakanaAILabs · x · 2026-09-15
Sakana AI 宣布其日语特化模型 Sakana Namazu 被医疗 AI 公司アイリス(Iris)的医师循证检索工具「Evidence Finder」采用。在基于 Sakana Namazu 的版本上解答 2026 年 2 月第 120 回日本医师国家考试,达到 96.4% 正确率(482/500 分,作答完成率 100%),据称是 GENIAC 指定国产基础模型中的最高分。Evidence Finder 强调引用透明与幻觉抑制,内置自动验证引用文献真实性的 Verify 功能;算法细节专利申请中。这被视为日本主权 AI 在医疗领域的落地案例。
「模型」频道最新
- 孪生素数界从246推进到188,GPT-6 Astra发布前夕再推至186 — RexDouglass · 2026-09-15
- OpenAI 桌面端语音降价约 60%,ChatGPT 语音时长扩至 2.4 倍 — athyuttamre · 2026-09-15
- 多家实测 high 档反超 max,博主批厂商刷分后包装最佳实践 — karminski3 · 2026-09-15
- Qwen3.8 27B 鹈鹕测试:0.21 美元跑出付费模型 3 美元效果 — DivideHorror3217 · 2026-09-15
- LlamaIndex 回击 Cohere Parse:Cohere Parse 五维基准仅约 50% 均分 — ravithejads · 2026-09-15
- DeepSeek 算子工程师自述:明知 AI 将取代自己,仍选择亲手加速这一进程 — WebAssemblyMan · 2026-09-15