Council 1.2 加入多模型盲评和外部答案客座位
ahumanbeingmars · reddit · 2026-07-28
- Council 1.2 会把同一个问题同时发给多个模型,再去掉模型名,让它们盲评彼此答案。
- 工具会给出一个 0-100 的分歧分数,用来衡量各模型答案差异有多大、谁比较“独立”。
- 新版本增加了 guest seat:你可以把 ChatGPT、Gemini、同事或别处的答案贴进去,让它也匿名参与评分。
- 它既支持云端模型,也支持本地/自建 OpenAI-compatible 服务,包括 Claude、GPT、Gemini、DeepSeek、Grok、Mistral、Perplexity、OpenRouter、Ollama、Apple 端侧模型,以及自建的 llama.cpp、LM Studio、vLLM 等。
- 还提供 CLI,用 --fail-above 40 这类参数做脚本里的粗略一致性检查;项目本身是 MIT 许可、无遥测、无需账号。
「编程与Agent」频道最新
- Ruff 0.16.0 让一个提示词修完整个代码库 — xeophon · 2026-07-28
- 开发者分享多模型路由实践:Warp 中编排 Opus 与 GPT — vikvang1 · 2026-07-28
- 用自然语言给AI下需求,最终会演变成重新发明编程语言 — bendee983 · 2026-07-28
- OpenAI 正为 AI 代码洪流重做代码审查流程 — every · 2026-07-28
- OpenCode 把 Kimi K3 加进了编程 Agent 模型列表 — zainhas · 2026-07-28
- 一套实用的云端 Agent 工具栈:Devin、Cursor、Open-Inspect 等 — vinvan · 2026-07-28