开发者开源 Jev 推理实验笔记本:模型路由与对抗性同行评审实验
arthurcolle · x · 2026-09-25
开发者 arthurcolle 开源了 jev-reasoning-lab 仓库,整理了基于 Jev(TypesafeAI)的可移植实验笔记本,内容包括:类型化决策、模型 lane 假设、推理视角(reasoning-lens)选择、结构变体、数值递归发现,以及一个带工具约束的对抗性「同行评审者」agent。仓库附带完整执行输出的 notebook 和 HTML 快照,可离线查看实验结果,适合对 LLM 推理实验与 agent 评审机制感兴趣的人参考。
「编程与Agent」频道最新
- DeepSeek Harness 发布官方桌面客户端,告别命令行安装 — oran_ge · 2026-09-25
- Vite 核心成员实测揭 oj 基准缺陷:内存或被高估超 100MB — cnakazawa · 2026-09-25
- DeepMind 论文:一条误导性提示可让 Coding Agent 成绩暴跌 46.7% — dair_ai · 2026-09-25
- Pawel Huryn:bug 修复基准能可靠测试模型对代码库的理解 — PawelHuryn · 2026-09-25
- 用本地 Qwen 27B 一次生成可打印 3D 模型与广告渲染图 — Fragrant_Scale6456 · 2026-09-25
- 非技术同事按「AI几分钟能做」承诺排期,工程师苦不堪言 — kmeanskaran · 2026-09-25