博主用同一任务实测 StepFun Preview 与 Qwen 3.8 Max 做 Apple FY2025 分析
CodeByPoonam · x · 2026-10-10
CodeByPoonam 给 StepFun Preview 和 Qwen 3.8 Max 布置完全相同的任务:分析 Apple FY2025 并制作商业分析演示稿。本帖是对比实测的发起帖,后续跟进内容展示了两个模型各自的产出和交付质量差异。
所属事件:同题实测:阶跃Step 5与Qwen分析苹果财报(2 条相关)→
「模型」频道最新
- 实测账单打脸定价:GPT-6 Luna 比 Haiku 5.5 同价省 40% — aakashgupta · 2026-10-10
- GPU kernel 基准爆料:DeepSeek v4.1 flash 力压 GLM-5.3 与 Haiku — teortaxesTex · 2026-10-10
- 实测对比:Step 5 出干净幻灯片,Qwen 出图表密集的报告页 — CodeByPoonam · 2026-10-10
- 实测关键环节:改数后检验两模型图表与计算能否正确联动 — CodeByPoonam · 2026-10-10
- 用户赞 Grok bot 隐藏 subagent 机制秒回,称其他 LLM 体验被毁 — rudrank · 2026-10-10
- 研究者爆料:某新模型疑似采用连续扩散,架构内置潜空间思考循环 — mblondel_ml · 2026-10-10