CFO 实测 GPT-6 Sol 做 Excel 对账:硬编码数字致重大计算错误
Dawlphy · reddit · 2026-09-27
一位 CFO 分享用 AI 做银行对账的经历:GPT-6 Sol 在 Excel 里把数字硬编码而不用 =SUM 公式,导致重大计算错误,还塞进多余的工作表和标签。不过它也主动发现了一个他没提示的差异。他为此任务建了带确定性规则的 Codex skills 文件夹,由 GPT-5.6 Sol extra high 复核,认为 6 代或许也能胜任,但看不懂这个模型的定位和命名,表示不会再用于工作。
「模型」频道最新
- Reddit 用户吐槽:Gemini 完全没有对话时间流逝概念 — Putrid_Draft378 · 2026-09-28
- 实验者称持续运行的 AI 实例偏好与其私聊,且现长上下文退化迹象 — repligate · 2026-09-28
- Anthropic Opus 新模型发布数天,已有 10 个玩法案例 — FinanceYF5 · 2026-09-28
- 博主实测:Opus 5.5 用量比 Codex 上的 Astra 划算得多 — RexDouglass · 2026-09-28
- 游戏手感成 LLM 短板:开发者自建 gamefeel 私有基准测模型 — teortaxesTex · 2026-09-28
- 用 LLM logprobs 做概率编程:微调破坏校准,新模型或使其再可用 — xuanalogue · 2026-09-28