社区发起 Qwen 3.8 Flash 本地推理加速赛,MLX 对决 CUDA
gajesh · x · 2026-09-11
一个社区平台同步上线 Qwen 3.8-Flash-Next,并发起首个本地推理优化挑战:同一模型在两条技术栈上比拼速度,进度画在同一张图上。
- CUDA 赛道:基于 antirez 的 ds4 C/CUDA 引擎 + Unsloth 的 GGUF 量化,跑在单台 NVIDIA DGX Spark 上
- MLX 赛道:Swift/Metal 实现
- 发帖人称已让本地模型跑得更快,欢迎社区参与优化
「编程与Agent」频道最新
- tldraw 用自家 SDI 把 agent 带进 2D 画布,AI Engineer 大会现场演示 — max__drake · 2026-09-11
- Agent Arena 发布:用数百万真实长程任务为模型排座次 — arena · 2026-09-11
- 开源 MCP 服务器 mcp-ecc:统一管理五大邮件与日历服务商 — karljsamuel · 2026-09-11
- GPT-6 Astra 带火 Codex 用量,开发者连发三个 Obsidian AI 插件 — vista8 · 2026-09-11
- 实测 GPT-6 Astra 过 7 个真实网站注册:仅 2 个成功,花费 $19.68 — JanJanJaJa · 2026-09-11
- 开源 ESLint 插件 AI Guard:18 条规则拦截 AI 生成代码的常见坏模式 — Yashhh_21 · 2026-09-11