已有 LLM 跑出 14000 tokens/秒,作者预言五年内前沿智能达 5000 tok/s
dolo937 · reddit · 2026-09-02
作者展望推理速度带来的范式变化:目前已有 LLM(chatjimmy.ai)跑出超过 14000 tokens/秒,OpenAI 的超快模式对用户约 750 tok/s,Minimax H3 生成视频的速度已超过观看速度。他预测五年内前沿智能将达到 5000+ tokens/秒,并抛出问题:当机器产出快过人类思考和消费的速度,世界会变成什么样?属于趋势观点讨论,无具体技术细节。
「漫话AGI」频道最新
- 119 家 neolab 吸走 943 亿美元,风投史上最大「先研究后收入」豪赌 — WhatTheLJW · 2026-09-02
- Cohere 研究副总裁 Sarah Hooker:推理时代正在改写十年 GPU 设计逻辑 — sarahookr · 2026-09-02
- Sarah Hooker:测试时计算与智能体工作流正迫使 AI 基础设施重构 — sarahookr · 2026-09-02
- 犯罪学家评Hugging Face泄露:多智能体AI才是真正的安全挑战 — sebkrier · 2026-09-02
- AI 素养不止会用工具:知道何时该把问题交还给人类 — moniquejmorrow · 2026-09-02
- Luke Wroblewski:下一代人不再学 GUI,agent 替你操作应用 — LukeW · 2026-09-02