实测金融分析:小模型排名一致性仅 15%,前沿模型达 75%

Rough_Practice7631 · reddit · 2026-10-07

作者在真实财报数据上对比了 Gemma 3 27B、Qwen3 32B 与 Opus 5、GPT-5.6 Sol 的判断可靠性,核心发现:

作者强调样本小,应视为方法论演示而非定论。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →