LLM 复杂数学推理强,但精确数值回归表现拉胯
lateinteraction · x · 2026-08-11
研究指出,尽管大语言模型(LLM)能够很好地推理复杂的数学问题,但它们在生成精确数值输出方面依然存在困难。作者将这类难以给出准确数值比例的任务定义为“推理密集型回归”(Reasoning-Intensive Regression, 简称 RiR)任务。
「研究」频道最新
- MIT 科技评论探讨 LLM 下一代演进:挑战 Transformer 架构的新势力 — volokuleshov · 2026-08-11
- Thrive 研究员分享前沿上下文工程与模型可解释性探讨 — thesephist · 2026-08-11
- 学者吐槽:LLM 正在无情拆解社科实证论文的「数据垃圾」 — RexDouglass · 2026-08-11
- CVPR 2026 论文 EgoX:单张第三人称视频生成第一人称视角 — rsasaki0109 · 2026-08-11
- 实测GPT-Pro:仅需4美元即可端到端形式化验证学术论文 — RexDouglass · 2026-08-11
- 西安交大提出 QQWorld:大幅提升世界模型规划成功率 — 机器之心 · 2026-08-11