博主实测:V4.1 Flash 堪称 proto-AGI,能自主搭科学工具与子代理流水线
teortaxesTex · x · 2026-09-14
博主 teortaxesTex 并行测试两个 Rust 解决方案生成,右侧的提示词对有用函数类别的引导更有效。
他在后续推文中称 Gemini 的 V4.1 Flash 是「proto-AGI」:它能稳定构建科学工具,还能聪明地组织子代理(subagent)流水线,甚至对 Python 的运用令人惊讶。他指出该模型并不算很聪明、会犯错误,但通向完全通用智能的路径已经足够清晰——「放大规模即可」。
所属事件:博主实测 Gemini V4.1 Flash 称其接近 proto-AGI(4 条相关)→
「模型」频道最新
- Dario 回应护栏争议:宁可被嘲笑,也不愿 Claude 被用来杀人 — TinfoilTricorn · 2026-09-14
- Plus 付费用户怒斥 OpenAI:3 条消息烧掉 77% 的 5 小时额度 — razzlesama · 2026-09-14
- 为什么生产环境几乎没人用<50M参数的微型专用模型? — Guna1260 · 2026-09-14
- 博主吐槽 Claude 评测很好用起来诡异,疑后训练引入怪癖 — MaziyarPanahi · 2026-09-14
- 开发者吐槽 Claude Opus 5 本周又变笨了 — draginol · 2026-09-14
- 79K 参数小模型实测 RLT:能学状态追踪但长序列泛化差 — mike64_t · 2026-09-14