双 RTX 5060 Ti 开启 P2P 仍然跑出 NaN
Environmental_Hand35 · reddit · 2026-07-25
一位用户在双 RTX 5060 Ti 工作站上测试 PCIe P2P(peer-to-peer)通信,使用的是打过补丁的 NVIDIA open kernel modules。nvidia-smi 显示两个方向都支持 peer access,但 CUDA 的 simpleP2P 正确性测试始终失败,返回 NaN,而且直接走 P2P 的路径还比 fallback 路径更慢。
帖中给出的配置与现象包括:
- MSI MPG Z890 Carbon WiFi 主板
- 2× RTX 5060 Ti 16GB
- Core Ultra 7 270K Plus,48GB DDR5-8800
- BIOS 里关闭了 VT-d/IOMMU,也尝试了不同内核启动参数
- cudaMemcpyPeer / cudaMemcpy 的带宽约 5.09 GB/s
- 但在验证阶段依然出现 NaN
作者希望其他 Blackwell 多 GPU 用户分享 simpleP2P 或 nvbandwidth 结果,用于对比和排障。
「Infra」频道最新
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27
- MiniBot 2.40 新增 xAI、HF Studio 和 vLLM 支持 — Creative-Type9411 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- QuixiCore 主张原生量化内核取代先反量化再执行 — QuixiAI · 2026-07-27
- Nvidia 被曝洽谈为 OpenAI 俄亥俄数据中心提供 2500 亿美元背书 — Wonderful_Buffalo_32 · 2026-07-27