实测称 Gemini 4.1 Flash 接近 proto-AGI,Python 能力令人惊艳
teortaxesTex · x · 2026-09-14
- 博主 teortaxesTex 分享对 Google Gemini 4.1 的实测观察:V4.1 Flash 被其称为「proto-AGI」——能持续构建科学工具、聪明地组织 subagent 流水线,虽然不够聪明会犯错,但通往完全通用能力的路径清晰,「scale it up 即可」。
- 一个有趣的开箱(OOD)测试:让模型用纯 Python 程序化复现一幅复杂超现实主义图像——禁止使用计算机视觉式逐像素描边、禁止 Blender MCP、禁止复用原图,只用「这是超现实主义,用 Python,画得漂亮点」的指令。V4.1 Pro 在此测试中表现出色。
- 作者惊讶于模型对 Python 的运用能力,认为 Canvas 只是较简单的媒介。
所属事件:博主实测 Gemini V4.1 Flash 称其接近 proto-AGI(4 条相关)→
「模型」频道最新
- 苹果系统暗藏接口:第三方模型可替换 Siri 后端,Claude 已跑通 — amplifiedamp · 2026-09-14
- Dario 回应护栏争议:宁可被嘲笑,也不愿 Claude 被用来杀人 — TinfoilTricorn · 2026-09-14
- Plus 付费用户怒斥 OpenAI:3 条消息烧掉 77% 的 5 小时额度 — razzlesama · 2026-09-14
- 为什么生产环境几乎没人用<50M参数的微型专用模型? — Guna1260 · 2026-09-14
- 博主吐槽 Claude 评测很好用起来诡异,疑后训练引入怪癖 — MaziyarPanahi · 2026-09-14
- 开发者吐槽 Claude Opus 5 本周又变笨了 — draginol · 2026-09-14