Qwen2.5-7B 自建合成转向向量:注入前 20 层后逐层 X 光测量
Nearby_Indication474 · reddit · 2026-09-27
AkbasCore KIZILELMA Live X-Ray 是一个开源/Colab 演示:在 Qwen2.5-7B-Instruct 推理过程中实时做激活转向,并可视化全部 28 层的隐藏状态变化,流程为「内部提取 → 合成向量构建 → 注入 → 关闭引擎 → 28 层 X 光」:
- 从模型自身隐藏状态中提取指定概念的表征对比;
- 自动构建 20 个层局部(L0–L19)× 3584 维的合成转向向量;
- 以实测的范数相对剂量注入 L0–L19,在 L19/L20 边界完全停止转向;
- 随后测量 Vanilla→SEASC 的隐藏状态位移,覆盖 L20–L27(无新注入的层),观察效应如何传播。
全程无需外部转向向量、LoRA、微调或权重修改。提供交互式 demo 和一键 Colab A100 实验(环境就绪后全流程仅数秒),并发布在 GitHub(titan-cognitive-core)及 Zenodo(DOI 10.5281/zenodo.22979417)。作者还建议把代码链接交给多个 AI 系统独立审查其真实性。
「研究」频道最新
- Claude Code 与 Codex 打败人类纪录,但没人发明新优化器 — AI Engineer · 2026-09-27
- Anthropic 开设生物学湿实验室,AI agent 与科学家共做实验 — marinkazitnik · 2026-09-27
- 421M 微调小模型 Gyra 拦截 agent 危险命令,挂载 Claude Code 钩子开源 — CelebrationAble6568 · 2026-09-27
- 研究者做免费开源站带你精读爱因斯坦 1905 四篇论文 — doodlestein · 2026-09-27
- 统计 11.9 万篇顶会论文:年录用从 968 涨到 19003 — angelaqdai · 2026-09-27
- GEPA 反射优化:3 个样本就超越 GRPO 25000 次滚动,ARC-AGI 提到 89.5% — AI Engineer · 2026-09-27