AkbasCore 3.0:不改权重的推理时激活引导,A100 实测剂量误差仅 0.0018pp
Nearby_Indication474 · reddit · 2026-09-22
独立研究者 Mustafa Akbaş 发布 AkbasCore 3.0(SEASC),在 Qwen2.5-7B-Instruct 上的推理时激活引导方案:不微调、不加参数,直接对中间层激活做受控位移。
- 方法:对每层用匹配对比句求语义方向向量 AL,并在干预前测量原始激活范数 ||hL|| 作为尺度,位移量 = i0×E(L)×||hL||×AL;参考配置 i0=0.10,DRA 包络沿 L0–L19 递减干预强度。
- 验证:L0 请求 10% 剂量、实测 10.0018%,全程平均请求 4.98% vs 实现 4.98%,CUDA 实现与数学设计高度吻合。
- 效果:同一场景组织任务,baseline 在第 4 项截断,SEASC 输出完整结构化回答且 4-gram 重复为 0%。
代码、原始 A100 输出日志与 Zenodo 记录均公开可复现。
「研究」频道最新
- JEVfire 开源:Qwen 0.8B 在浏览器里 71ms 一步通关超级马里奥 — ricklamers · 2026-09-22
- RegVGGT:每帧仅留 1% token,消费级 GPU 跑长视频 3D 重建 — zhenjun_zhao · 2026-09-22
- D3GS:深度+DINO+扩散三重引导,稀疏视角 3DGS 重建显著提升 — zhenjun_zhao · 2026-09-22
- VGGT-Prime:用路由给注意力头分级,削减视觉几何 Transformer 冗余算力 — zhenjun_zhao · 2026-09-22
- Elevator-VIGS:VLM 零样本识别电梯,SLAM 乘电梯不再丢失跟踪 — zhenjun_zhao · 2026-09-22
- BayesianGS-SLAM:用贝叶斯不确定性统一 3DGS 建图与跟踪 — zhenjun_zhao · 2026-09-22