一个 Codex Skill 让它同时调用 Grok 和 Kimi 复核答案
vista8 · x · 2026-07-24
在 Codex 里安装一个 Skill,让它调用 Grok 和 Kimi 做模型交叉评估。
- 作者的核心观点是:一个大模型的结论不一定可靠,最好再用其他模型复核。
- 安装方式是 npx skills add joeseesun/qiaomu-model-cli。
- 评论区里给了开源地址,后续还能继续扩展接入更多模型。
- 配图补充的是一段更具体的技术讨论:围绕视频理解、时间对齐和字幕/转写 schema 的设计,讨论了当前方案的局限,以及如何更稳妥地做 A-lite 场景认知契约。
所属事件:开源Skill让Codex并行评测Grok与Kimi(3 条相关)→
「编程与Agent」频道最新
- 开发者用 Claude 搭建 3D 城市生成与天气引擎 — repligate · 2026-07-24
- Mnemos 放弃全自动编排,转向 agent 身份与连续性 — RileyRalmuto · 2026-07-24
- Codex 做出串场路线应用,帮他排 100 多场酒吧活动 — gabrielchua · 2026-07-24
- Long-Horizon Terminal-Bench 更新长时程终端代码评测榜 — Muennighoff · 2026-07-24
- GPT-5.6 Sol 被演示在 Chrome 里取消关注非人类账号 — cocktailpeanut · 2026-07-24
- 开源税务引擎在 TaxCalcBench 拿下 96% 刷新纪录 — Intelligent_Prompt18 · 2026-07-24