LLM 荐股评分近于抛硬币,开发者用股价当标签重做新闻筛选器

Fun_Water2230 · reddit · 2026-09-24

作者曾发布金融模型 deepmoney,长期在中国 A 股新闻的 LLM 流水线上工作。他核查了旧流水线的「投资重要性」评分:AUC 一个月 0.59、另一个月 0.47,基本等于抛硬币;模型自评的「股票相关性」对 20 日超额收益的 rank IC 为 −0.094,符号还是反的。结论:文笔漂亮、毫无信号。

于是他把评分全部推翻,以「市场是唯一裁判」重建整个系统:

诚实说明:27B 尚未全量训练(仅在 Qwen3-0.6B 上冒烟测试),需要击败的基线是文本盲 GBM(价格 0.55–0.57 AUC、量能 0.68–0.70)。代码 MIT 开源,附 283k 条带标签中文新闻数据集(非商业研究用途)。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →