Codex做出浏览器采样器

Deep-Efficiency9146 · reddit · 2026-07-18

作者把 GPT-5.6/Codex 当成一个“有点混乱但会记架构”的产品团队,反复迭代去做一个浏览器里的 9-pad sampler,数据源是随机截取 YouTube 片段。

这次实验里,它最终做出了不少复杂的浏览器音频逻辑:

作者认为最难的不是界面,而是 浏览器音频权限、BPM 变化时保持 sequencer 稳定、避免 buffer 间爆音、以及防止旧音频泄漏到新 Pad 状态。

一个有意思的结论是:Codex 在面对大文件里的复杂问题时,表现最好的一种提问方式不是“猜 API 错了什么”,而是像音乐人一样描述症状,比如“下一轮循环听起来像尾音被过早切掉”。

作者把成品放在了链接里,主要是想观察:有没有人也在用这类模型做 长周期、反复调试的创意工具开发,而不只是“一次性生成应用”。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →