93 秒 2.6Wh:激活引导几何固化进 Qwen2.5-7B 权重提升 15.8%
Nearby_Indication474 · reddit · 2026-09-23
Reddit 用户发布 AkbasCore 3.0 / SEASC 实验:不依赖外部教师模型或外部数据,从 Qwen2.5-7B-Instruct 自身内部表征中提取逐层「引导罗盘」,再用 AkbasCore 沿受控轨迹推动模型激活,通过 LoRA 梯度更新把该几何固化进参数,随后完全移除引导引擎与 LoRA 运行时适配器(已合并进权重)。
- 硬件:单张 A100-SXM4-40GB,固化训练约 93 秒、能耗 2.63 Wh
- 锁定的最终测试(未参与训练与选点)+15.79%,验证集最优 +15.63%,方向对齐 0.523
- 系统自带过冲检测:update 40 为最佳状态,update 70 触发 OVERSHOOTDETECTED 并回滚
作者强调这不是「93 秒超越 LoRA」:LoRA 是写入机制,AkbasCore 负责生成几何,模型自身提供目标方向。实验要回答的是:被临时施加的激活几何能否在电机移除后留存于权重中——答案是可测量地留存了。
「研究」频道最新
- SemiAnalysis 实测 Engram DRAM offloading 性能提升最高 50% — bookwormengr · 2026-09-23
- Grounded Action Model:用 3D grounding 替代 VLA 构建机器人基础模型 — DJiafei · 2026-09-23
- ValsAI 称十个 Claude agent 15 小时做出经 Lean 验证的算法改进 — alejandroll10 · 2026-09-23
- 斯坦福发布 Terminal-Bench-Science:70 项科学任务最强模型仅解出 30% — geoffwolfe · 2026-09-23
- 实测:零训练 Qwen 横扫专门训练的决策模型 35 分 — KingPinX · 2026-09-23
- UCL 研究:LLM 共享 Fisher-Rao 信息几何,可低扰动干预模型行为 — UniversityCollegeLondon · 2026-09-23