Allie Miller 实测:Claude Opus 5.5 首次通过她「代码×诗歌」挑战
alliekmiller · x · 2026-09-24
AI 创业者 Allie Miller 表示她多年来认为 OpenAI 模型在创意构思上最强,但被 Opus 5.5 改变:1) Opus 5.5 是唯一通过她长期「代码 meets 诗歌」挑战的模型(她只向一家实验室分享过该测试);2) 做幻灯片时同时让 Codex 和 Claude Code 出设计方案——Codex 一团糟,Claude Opus 5.5 用 GPT 的 image 2.5 生成了 6 个 PNG 版本、完美命名、存盘、打开 Finder 并主动表达偏好;确认偏好后自动生成为可编辑 PPT(文本框、形状齐全),且她并未要求。她还提到早期测试中的工具调用失败似乎已被修复,认为 Opus 5.5 是一台「挥舞工具的机器」,创意明显强于以往 Claude。
「模型」频道最新
- GPT-6 系列能力不及 GPT-5.6,首次出现代际升级反而变弱 — srchvrs · 2026-09-24
- OpenAI 发布 GPT-6 Sol 与 Luna:API 定价较 GPT-5.6 降 50% — DeryaTR_ · 2026-09-24
- NVIDIA 开源 Nemotron 3 说话人分离模型,登顶 VoiceArena 榜单 — solyarisoftware · 2026-09-24
- 用户实测:Opus 5.5 做金融建模比 Fable 慢 10 倍 — JOBhakdi · 2026-09-24
- OpenAI 升级 ChatGPT 语音:可调用邮箱日历 Slack 并驱动 GPT-6 — Dimillian · 2026-09-24
- Code Arena 推出 WebDev 排行榜,可在线体验对比 — arena · 2026-09-24