Codex 周活破 500 万,AI 模型透明度与评估引热议
altryne · x · 2026-07-24
本期 ThursdAI 播客聚焦 AI 编程工具与模型评估的最新动态:
- Codex 数据与进展:OpenAI 开发者关系负责人 Romain Huet 透露,Codex 周活跃用户已突破 500 万,迎来了重要拐点。节目探讨了其新功能(如 /goal、AppShots、自主管理线程)以及未来 GPT-5.6 的方向。
- AI 日常工作流:分享了作者每天实际使用 AI 的 15 分钟经验,包括用 Computer Use 修复小痛点、为家庭旅行构建的工具等。
- 模型评估与安全:与 Insecure Agents 对谈,讨论了 Wolfbench 评估体系,强调随着模型能力提升,解决身份验证和授权问题已迫在眉睫。
所属事件:Codex周活破500万并预告新功能(2 条相关)→
「编程与Agent」频道最新
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11