Sentence Transformers v6.0 提速:fp16+FlashAttention 比 fp32 快 3.87 倍
tomaarsen · x · 2026-08-18
v6.0 的性能改进:多列损失(multi-column losses)现在对合并后的列只跑一次前向传播,在难负例与三元组训练上提速约 1.25 倍,且损失曲线完全一致;fp16 + FlashAttention 成为 Sentence Transformers 最快的 GPU 配置,相比 fp32 提速 3.87 倍。同帖还列出 v6.0 的破坏性变更:transformers v5 与 torch 2.2 成为最低版本要求、similarity/similaritypairwise 从属性改为方法、自定义模块类需 trustremotecode=True(含本地路径)、裸的聊天消息列表现在表示单个对话而非一个批次。
所属事件:Sentence Transformers v6.0 发布:晚交互多向量模型成一等公民(27 条相关)→
「编程与Agent」频道最新
- Swarm 商用落地:无人机巡逻希腊光伏,AI 客服处理 97% 疑问 — bittingthembits · 2026-08-18
- DeepSeek 开源全能 Agent 运行时,支持多厂商编排 — abhishek__AI · 2026-08-18
- Gemini 推出带 Linux 沙箱的 Managed Agents — _philschmid · 2026-08-18
- ZenML 开源 Kitaru:生产 Agent 轨迹可重放换模型做反事实实验 — htahir1 · 2026-08-18
- 观点:生成代码比包管理器代码更安全 — rickasaurus · 2026-08-18
- 一年内从手写九成五代码到不足百分之一 — cross__entropy · 2026-08-18