频道 · CHANNEL
Infra
「Infra」是 AI 资讯网站 AGI Hunt 的主题频道,全天候实时更新。覆盖:算力、GPU/芯片、数据中心、推理/服务栈、训练成本、供应链与算力经济(含算力公司财报)。
每日概览:AI 资讯日报最新一期——过去 24 小时全站及各频道、各公司热点的结构化梳理 · 往期归档
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27
- MiniBot 2.40 新增 xAI、HF Studio 和 vLLM 支持 — Creative-Type9411 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- QuixiCore 主张原生量化内核取代先反量化再执行 — QuixiAI · 2026-07-27
- 传英伟达拟为OpenAI俄亥俄州2500亿美元数据中心提供担保 — Wonderful_Buffalo_32 · 2026-07-27(8 条相关)
- Google JAXBench 给 TPU 内核优化补上 50 项实战基准 — omarsar0 · 2026-07-27
- 图表称 Anthropic ARR 已比 OpenAI 高出 328 亿美元 — wen_ragnarok · 2026-07-27
- 英特尔披露 18A 已量产,14A 正推进下一代制程 — BenBajarin · 2026-07-27
- RTX 3090 Ti 跑模型该选 fp16、fp8 还是 int8 — throwaway0204055 · 2026-07-27
- Modal 直跑 Blender 渲染:L40S 实测最快,单次成本不到 1 美分 — charles_irl · 2026-07-27
- Intel 10-Q 里一个细节:服务器 CPU 平均售价上涨 48% — BenBajarin · 2026-07-27
- WMO 推出模型路由器,称可把 agent 成本降 40%+ — SilenN · 2026-07-27
- Alphabet 被指背书 2.4 吉瓦 AI 容量、覆盖 10 个项目 — BenBajarin · 2026-07-27
- 百时美施贵宝将与 Nvidia 共建制药 AI 超算 — owl_posting · 2026-07-27
- Reddit 讨论 AI 投资泡沫是否要破,RAM 价格会否回落 — RuiRdA · 2026-07-27
- AI-Trader 内置 MCP,让 LLM 直接跑量化回测 — tom_doerr · 2026-07-27
- 新 GGUF 格式 Q8_CR 让 Krea 2 速度接近 INT8 — molbal · 2026-07-27
- Nvidia 签下 15 亿美元 Amkor 合作扩产美国封装产能 — Beth_Kindig · 2026-07-27
- PyTorch DDP 默认没吃到这个 NVIDIA GPU 优化 — gordic_aleksa · 2026-07-27
- 纯本地AI女友语音Demo跑通15GB显存技术栈 — max_paperclips · 2026-07-27(2 条相关)
- OpenAI 传出将斥资 300 亿美元建 3.2GW 佐治亚数据中心 — Beth_Kindig · 2026-07-27
- ComfyUI 实测:两张 RTX 5080 还是跑不过一张 RTX 5090 — Geekdomo · 2026-07-27
- 开源剖析器可追踪语音 Agent 每次 STT、LLM、TTS 调用 — mahimairaja · 2026-07-27
- SemiAnalysis:AI推理时代内存与速度比GPU更关键 — rwang07 · 2026-07-27(2 条相关)
- llama.cpp 合入 GLM-5.2-Vision 本地多模态支持 — QuixiAI · 2026-07-27
- 便宜存储让 SCD Type 2 显得过时,作者主张改用每日快照 — Zachly · 2026-07-27
- Copilot 变免费后,他在想要不要卖掉双卡 AI 主机 — tweetibird · 2026-07-27
- 开放模型一年内占 token 比例从 10% 升至 30% — togethercompute · 2026-07-27
- AI 存储梗图称营销答案是 5.3,工程指标仍未定 — JoshuaJBouw · 2026-07-27
- NVIDIA 认为 AdamW 碰到上限,SOAP 和 Muon 在万亿 token 训练中更强 — omarsar0 · 2026-07-27
- 做本地 LLM 机器时该盯 RTX Ada 还是 5090 — egudegi · 2026-07-27
- 一篇文章拆解如何降低 Microsoft Fabric 容量成本 — adnan_hashmi · 2026-07-27
- Microsoft Fabric 的 sempy.fabric 包入门指南 — adnan_hashmi · 2026-07-27
- Voice AI 通话真实成本不止按分钟算 — decant338 · 2026-07-27
- 美光与 Meta 白皮书称 Spark 溢写 SSD 后可慢 38 倍 — dr_alphalyrae · 2026-07-27
- AI 推理服务被指比自租 GPU 贵 7 到 15 倍 — JoshPurtell · 2026-07-27
- CUDA 基准测出 6400 万数求和快 20 倍 — ctjlewis · 2026-07-27
- AI 基建把数据中心融资逼进更复杂的资本结构 — GaryMarcus · 2026-07-27
- 有人在问:RAID 0 NVMe 组合能否提升 Pulsar 跑大模型 — Wyldkard79 · 2026-07-27
- GLM-5.2 在 RTX 5090 上推理提速至 80–110 tok/s — markjeffrey · 2026-07-27
- Hermes Agent 用渐进披露扩展 MCP 工具,几乎不掉准确率 — Teknium · 2026-07-27
- Laguna 测试 2.75 和 3.25 bpw 量化方案 — QuixiAI · 2026-07-27
- 开源 HART OS 要让前沿 AI 不再依赖数据中心 — hevolveai · 2026-07-27
- Chutes 靠跨洲租卡训练 20B 模型,每小时成本不到 10 美元 — markjeffrey · 2026-07-27
- llama.cpp 合入 Minimax-M3 视觉与 MSA 支持 — Time_Reaper · 2026-07-27(2 条相关)
- AST-grep 用 Rust 重写 Tree-sitter,称快了 30% — herrington_d · 2026-07-27
- Windows 11 上 ComfyUI 跑通 Sage Attention 和 FlashAttention 2 — Left_of_Laniakea · 2026-07-27
- Baseten将GLM-5.2提速至280 tok/s — iamrobotbear · 2026-07-27(3 条相关)
- 马斯克等巨头力挺开源,AI 竞争的终局在基础设施? — myllmnews · 2026-07-27