从业者实测:新模型写代码看似流畅,应用级 ML 任务仍会犯严重错误
ivan_bezdomny · x · 2026-09-07
作者表示,每次担心新模型能独立写出高质量代码、文档和计划时,深入检查后总会发现它在做出非常严重的错误判断——至少在中等难度的应用级 ML 工作上如此。结论:人类从业者仍然不可或缺。
「模型」频道最新
- Astra Max 被赞数据分析师:极详尽、洞察深,贵但值 — bindureddy · 2026-09-07
- 曝黄仁勋宣布「AGI 已来」:OpenAI 发布 GPT-6 Astra — Polymarket · 2026-09-07
- GPT-6 一条提示做出 Minecraft 可驾驶汽车无模组 — mindiving · 2026-09-07
- 博主惊叹 Astra 已发布,OpenAI DevDay 却近在几周后 — brandon_galang · 2026-09-07
- 实测发现 GPT-5 批量走步能力严重拉垮,不批量也吃力 — patience_cave · 2026-09-07
- 开发者质疑:Astra 是量化版模型?口感像被压缩过 — willcb · 2026-09-07