「还觉得 LLM 数学差?那是你的问题」,热帖断言模型数学能力已被低估
alejandroll10 · x · 2026-10-07
alzzyd 发推称,如果到现在还认为 LLM 数学能力不行,「那真的是使用者的问题(skill issue)」——暗示主流前沿模型在数学任务上的表现已经足够强,负面印象源于使用方式落后。该观点被多人转发,引发讨论。
「模型」频道最新
- HuatuoGPT-3 仅 27B 在 HealthBench 达 70.1,超越 GPT-6 Astra — CUHKSZ · 2026-10-07
- 开发者抱怨长任务夜间撞用量上限,auto reload 未生效 — willdepue · 2026-10-07
- Gary Marcus 回应质疑:前沿 LLM 能否裸解开放数学难题? — GaryMarcus · 2026-10-07
- 从 9.9>9.11 翻车到挑战最难数学题,两年 AI 反差 — Yuchenj_UW · 2026-10-07
- OpenAI 宣称解决 372 个未解难题,平均每题仅耗约 3 小时 — i_dg23 · 2026-10-07
- 实测:OpenAI Decisions API 比 Jev 贵 2 倍、效果差 5-10% — xeophon · 2026-10-07