Perplexity 本地优先智能体:Qwen3.8 27B 跑出近零成本知识工作
机器之心 · wechat · 2026-08-30
Perplexity 发布 Portable Computer,一个默认完全在本地运行的智能体:模型、框架、对话和轨迹都留在用户设备上,敏感数据不出设备,本地推理零费用;网络搜索、连接器或升级到云端顾问模型仅在用户批准时才跨越设备边界。其核心思路是模型与框架协同设计——不让本地小模型(如 Qwen3.8 27B)勉强驱动为大模型设计的通用框架,而是让框架围绕模型能力量身定制:上下文超 10 万 token 性能下降就做模块化按需加载技能、把常用 MCP 服务器转成精简命令行工具、加入自我验证钩子、OS 级沙箱默认强制开启。
实测中,在 NVIDIA DGX Spark 上以 Qwen3.8 27B 运行,Portable Computer 在网络搜索(BrowseComp 66.7% vs Hermes 50.2%/Pi 43.9%)、多模态文档理解(ParseBench-100 65.1%)等基准上全面领先开源框架,且运行时间与 token 消耗最低。需要强推理时可调用前沿模型做「顾问」:TerminalBench 2.1 上从 59.6% 提升到 73.0%,每次部署 API 成本仅约 0.415 美元(单独跑 Claude Opus 5 为 82.4%/0.65 美元)。Perplexity 还用合成 RL 环境对 Qwen3.8 27B 做两阶段后训练得到 PPLX 27B,在内部 Local Knowledge WorkBench 上把得分从 82.6% 提至 85.4%。
「编程与Agent」频道最新
- Claude Code 等 Agent 进化神速,演示震撼远超文字描述 — tinyfool · 2026-08-30
- 律师用 Cursor 自建 AI 高管团队,3 小时内容流程压到 10 分钟 — Specialist_Call_1257 · 2026-08-30
- 机器人项目实战:Claude 编码彻底失效,基础架构成最大障碍 — verdakorz · 2026-08-30
- 强模型给弱模型搭脚手架:不训练小模型,准确率近乎翻倍 — 机器之心 · 2026-08-30
- 11 年前手写 JS 婚礼请柬,如今 AI 一次生成安卓动态壁纸 — steren · 2026-08-30
- 全栈开源体验:Qwen+Hermes 打造可自我修改的电脑 — ramagetime · 2026-08-30