Speck 把认知搬进运行时:qwen3:4b 跑赢裸跑 8B,速度快一倍
Electronic-Space-736 · reddit · 2026-10-06
开源项目 Speck 提出把记忆、注意、规划、证据追踪、置信度、学习与元认知等认知机制从 prompt 移入运行时的确定性软件中,让小模型在持久的认知架构下工作——「模型可丢弃,认知状态不可丢」,worker 可换模型、重启、迁移设备而不丢任务状态。
- 实测对比(8 案例 × 2 轮,相同采样与 1024 token 上限):Speck + qwen3:4b 得 15/16,单案 7.9 秒、显存 5.7GB;裸跑 qwen3:8b 仅 13/16、13 秒、6.7GB;裸跑 qwen3:4b 为 10/16
- 核心主张:作者对比 OpenClaw,认为后者是优秀的 agent 运行时,而 Speck 是「认知运行时」——判断哪些语义判断真正需要模型、跨周期保留证据、独立校验判断,其余交给确定性机制。例如 1.2B 模型做不好矛盾识别,常规答案是换大模型,Speck 的答案是让环境本身足够智能
- 仓库含自评对比表:Speck 在认知架构、小模型放大、可观测性上评分领先,OpenClaw 在工具生态、集成与生产成熟度上占优
代码开源于 GitHub(doctarock/Speck)。
「编程与Agent」频道最新
- Matt Pocock:把 AI 编码技能定制成你自己的工作流 — mattpocockuk · 2026-10-06
- 斯坦福 ACE 团队推出 Sentry:失败知识常驻上下文反而拖累 Agent — StanfordAILab · 2026-10-06
- 防 Claude 封号:Shadowrocket 七步 TUN 配置堵漏指南 — aigclink · 2026-10-06
- ChatGPT 插件提交流程简化:上传 zip 即可送审 — Dimillian · 2026-10-06
- 一个工具搞定抓取+提取:开发者实战解决 Agent 上下文溢出 — OkShirt9372 · 2026-10-06
- 跑了几十小时端到端基准,Strata 推理服务器在完整构建任务上翻车 — julianharris · 2026-10-06