139 篇语义决策引擎研究系统化:仅 4 篇用匹配实测支撑实时性宣称
Delong Li · hf · 2026-10-06
- 研究对象:如 Jev 这类语义决策引擎可能返回「有效」答案却错过网络截止时间、选择不可行动作或让服务未经验证。论文按决策接口、执行路径与检查归属,系统化梳理了 139 个论文家族。
- 核心发现:50 个家族宣称引擎能适配控制回路或时间预算,但只有 4 个用匹配的测量支撑该宣称;全部 139 个中仅 4 个报告了截止时间达成率。缺口集中在决策缺少确定性计算步骤的地方——72 个家族做出 22 项相关宣称,无一被支撑,仅 2 个指定了覆盖检查的责任方。
- 实验证据:在同一事件模型下的有界测试中,每个缺口都能逆转准入判定:对每个孤立请求都满足 10 秒预算的决策,一旦决策在重放执行时间前排队,就一个请求也不满足;同一引擎通过一个覆盖检查却在另一个上失败。
- 产出:论文给出最低报告记录、设计规则与研究议程,用于决定哪些决策引擎可被准入控制回路。
「研究」频道最新
- 人形机器人拉黄包车:上海创新研究院论文攻克耦合负载全身控制 — ChongZzZhang · 2026-10-06
- GPU 并行不等于随机数生成器:blelbach 反驳大模型非确定性论 — blelbach · 2026-10-06
- 谷歌 AIM 论文:给研究 Agent 建"想法地图",提速 3.1 倍逼近最优 — rohanpaul_ai · 2026-10-06
- 三星提出 FLaRe:流匹配潜空间推理,1/4 延迟达到显式 CoT 97% 准确率 — SamsungResearch · 2026-10-06
- Foil 方法让循环 MoE 翻倍专家数,百B token 预训练损失降 0.012 nat — Shouren Wang · 2026-10-06
- 6G Open RAN 实测:Jev 决策模型 99.8% 达成 1 秒预算,托管 LLM 最低 0% — Delong Li · 2026-10-06