1B参数西语网络安全视觉模型VectraYX-Vision开源
Juan S. Santillana · hf · 2026-08-12
发布了一款参数量不到 2B 的西班牙语/拉美区域网络安全视觉语言模型 VectraYX-Vision-1B。
- 架构设计:将冻结的 SigLIP 编码器通过 MLP 与西语解码器耦合。
- 实验发现:引入了 NoPE(无位置编码)位置编码消融实验。尽管模型的功能管线运行正常,但报告显示其视觉定位(visual grounding)能力接近于零。
- 开源状态:已开放模型权重,并分享了后续的修复改进计划。
「模型」频道最新
- Nous Research 预告将开源新模型,喊话社区选目标 — NousResearch · 2026-08-12
- ChatGPT o3 频繁故障:生成内容中途意外截断 — Aine_123 · 2026-08-12
- 研究称 Kimi K3 未现推理蒸馏痕迹,或仅存数据污染 — bookwormengr · 2026-08-12
- 30亿参数OCR模型跑在浏览器:纯Rust编译,数据零上传 — doodlestein · 2026-08-12
- 社区呼吁 Arena 彻底改革图像与视频模型评测 — PAstynome · 2026-08-12
- 单卡 32GB 实测:Qwen 27B 编码优于 35B,但本地模型仍难独立自查 — WSTangoDelta · 2026-08-12