法律案例幻觉基准:Gemma4:26b 险胜 Claude

MRGWONK · reddit · 2026-09-24

作者为法律研究开发了 MCP 工具(syfert.com/mcp),并据此构建案例幻觉基准测试。结果显示 Gemma4:26b 在法律研究任务上略胜 Claude Fable 5.1。这为模型在法律场景的可靠性对比提供了新参考。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →