实测 GLM 5.3 Flash:写代码和查资料强,炒股和想点子差
ManagementNo5153 · reddit · 2026-09-10
作者分享用不同 harness 测试 GLM 5.3 Flash 等模型的实战印象:
- 编程:最出彩,隔天就能做出工具和爬虫,跨语言移植(Python/JS 移植到 Go 提性能)几乎即写即用
- 炒股:接入 alpaca 账户后发现模型倾向保守防御,建议减仓最赚钱的持仓以分散风险,不适合主动交易,但记账追踪有用
- 研究:价值最大,精确定位事件日期、联系方式、链接等具体信息非常有效
- 邮件与文案:能保持上下文,跟进邮件连贯,帮他处理了保险理赔
- 商业点子:很差
整体是个人使用体验,无系统评测数据。
「模型」频道最新
- Reddit 用户拆包 safetensors:DeepSeek V4.1 Flash 实为 748B 参数 — DistanceSolar1449 · 2026-09-10
- Kimi K3 上线 RunPod:2.8T 参数、1M 上下文,$3/$15 定价 — Kimi_Moonshot · 2026-09-10
- 一周烧掉3亿 token 仍未触顶,GLM 5.3 额度宽松引热议 — saibharadwaj · 2026-09-10
- 爆料补注:V4 系列或已有 3T 参数模型, Scaling 风险是关键变量 — teortaxesTex · 2026-09-10
- 爆料推算:DeepSeek V4.1 Pro 或为 3.1T 参数 MoE,磁盘占用 2.6TB — teortaxesTex · 2026-09-10
- 新书教程:零基础从零训练微调自己的 GPT 级小模型,附全套 Colab — Roger_M_Taylor · 2026-09-10