DeepSeek 实测:与非技术人员协作完成复杂财务建模
kmouratidis · reddit · 2026-08-03
DeepSeek-V4-Flash 实测体验
针对近期社区对 DeepSeek-V4-Flash 模型的负面评价(如严重幻觉、能力不足),作者通过一次真实的协作场景为其辩护,认为该模型在合适的工作流下表现可靠。
测试背景
- 任务:与非技术背景的会计师朋友合作,基于 Reddit 的 10-K 报告构建 5 年期财务三表模型预测。
- 环境:VSCode + ZooCODE,通过 LiteLLM 代理连接本地 vLLM 部署的 DeepSeek 模型。
实际表现
- 指令理解:面对用户极其简短且模糊的初始提示,模型能自行推理计划、查找安装依赖库并提出问题。
- 零幻觉:在生成 Excel 模型的过程中,未发现任何数字层面的幻觉,且能自行捕捉并修复大量错误。
- 专业直觉:模型甚至主动询问是否使用财务建模中常见的“plug(倒挤平衡项)”来修复资产负债表偏差,展现了其在财务领域的训练深度。
「编程与Agent」频道最新
- 资深开发者:拥抱AI Agent需放弃逐行看代码 — ericelliott_ · 2026-08-03
- 安全专家:AI Agent 将威胁研判时间从数天缩至数秒 — brucemacv · 2026-08-03
- 实战分享:用 Codex 自动将客户反馈转为产品路线图 — gdb · 2026-08-03
- 用 Claude 与 Codex 重写生物信息学工具 pydREG — anshulkundaje · 2026-08-03
- 仅靠一句提示词,Opus 5 用循环智能体生成 3A 级游戏 — mattshumer_ · 2026-08-03
- 用编程智能体打造吉卜力风旧金山等距互动地图 — keerthanpg · 2026-08-03