AI 资讯日报 · 2026-07-06
今日总结
7月6日以「GPT-5.6正式落地」与「Fable 5计费模式转型」为双核心:昨日还在 Polymarket 押注的 GPT-5.6 Sol/Terra/Luna 已经发布,但 OpenAI 仅公开单项基准,引发对模型真实水平的猜测;与此同时,Anthropic Fable 5 宣布两日内切换为按量计费,在高度活跃的用户社区中引发大量讨论与成本对比。开源侧,MIT 许可的 LongCat 2.0(1.6T 总参数、48B 激活)强势进入 LocalLLM 社区;科研侧,阿里达摩院 ElementsClaw AI Agent 以 28 GPU 小时筛选 240 万晶体结构,实验室确认 4 种新型超导材料,是今日最具分量的应用科学突破。
-
GPT-5.6 Sol/Terra/Luna 正式发布,基准信息极为有限 — OpenAI 发布三版本 GPT-5.6,但仅公开一项流行行业基准,社区解读分化:要么是压倒性优势刻意留底,要么在综合基准上存在短板。5 帖聚簇。原帖
-
网传 Sam Altman 称 GPT-5.6「发现新数学」(真实性存疑) — Reddit 截图援引该说法,但发帖者粉丝量为零,OpenAI 与 Sam Altman 本人均未证实,热度 7.77 居当日榜首,属网传内容,仅供参考。原帖
-
LongCat 2.0 以 MIT 许可开源(1.6T 参数、48B 激活) — 疑似 MoE 架构,已在 ModelScope 等平台发布,3 帖聚簇、热度 7.31,是近期规模最大的开源权重模型之一,直接进入 LocalLLM 社区视野。原帖
-
Fable 5 即将切换为按量计费 — 多位用户证实两日内生效,有人反映两小时烧掉 200 美元并转用 GPT 5.5;Polymarket 还显示新 Opus 下月底前发布概率 70%,订阅者面临明确的留存压力。原帖
-
CAIS/Scale:Fable 5 可自动完成 16.1% 真实远程工作 — Remote Labor Index 新结果显示,Fable 5 在带需求文档的真实远程任务上的自动完成率约为 Opus 4.8 两倍,是衡量前沿模型实际「顶岗」能力的关键数据点。原帖
-
阿里达摩院 ElementsClaw:28 GPU 小时筛选 240 万晶体结构,确认 4 种新超导材料 — AI Agent 将候选从 240 万缩减至 6.8 万再确定 4 种,经实验室合成验证,3 帖聚簇、热度 5.58,AI 驱动材料发现进入可复现的实验验证阶段。原帖
-
Anthropic 推出免费 AI 课程并颁发证书 — 涵盖 Claude 入门、AI 素养、Agent Skills 以及在 Google Cloud Vertex AI 与 Amazon Bedrock 上部署等方向,3 帖聚簇、热度 5.65,是 Anthropic 首次系统性开放教育入口。原帖
-
宇树 G1 机器人在印尼办公室撞到员工 — 视频曝光后在 Reddit 广泛传播,热度 5.53,引发对人形机器人在非受控真实场景中安全边界的直接质疑。原帖
-
AI 实验室掀起哲学人才招聘热潮 — 《纽约时报》报道,哲学与批判性思维背景人才成为 AI 实验室抢手岗位,4 帖聚簇、热度 5.57,「文科复仇」叙事在社区广泛共鸣。原帖
-
ByteDance Seedance 2.0 视频生成提示词社区热传 — 4 帖聚簇、热度 5.82,大量创作者分享实测工作流,Seedance 2.0 在中文视频生成社区快速建立存在感。原帖
与昨日对比
-
新增热点:
- LongCat 2.0 开源(1.6T/48B,MIT 许可)为全新进展,昨日社区无相关讨论
- 阿里达摩院 ElementsClaw 超导材料发现跨越实验验证门槛,昨日研究方向未涉及
- 宇树 G1 机器人办公室撞人:具身安全话题首次以负面案例形式冲上高热度
- Fable 5 计费切换倒计时(两日内生效):从昨日「省 token 技巧」演变为「走留决策」
-
持续发酵:
- GPT-5.6:昨日 Polymarket 押注 75%,今日 Sol/Terra/Luna 三版本实际落地,从预期兑现为事实,但仅公开单项基准,讨论热度依旧
- Fable 5 社区反馈:昨日聚焦省 token 技巧(图片输入),今日转为计费模式变化与成本对比,关注从技巧扩展至商业可持续性
- Claude Code 生态:昨日受阿里封禁事件冲击,今日回归工具链建设(Matt Pocock 技能合集 GitHub 达 15 万星、OpenAI Codex 的 Claude Code 插件发布等)
-
明显降温:
- Mistral Leanstral(昨日热度 8.81 居首,今日跌出前五十,无明显聚簇延续)
- 白宫逐案审批 AI 访问权(昨日热度 4.89,今日基本消失)
- 德国 Quantum Systems 12 亿美元融资(昨日热度 6.18,今日无延续讨论)
编程与Agent
- Matt Pocock 开源 Claude Code 实战技能集 — GitHub 项目
.claude/skills单日新增近千星、累计超 15 万星,面向真实工程场景的 Shell 脚本合集,热度 4.95,当日工具链传播最广的资源。原帖 - OpenAI 为 Codex 发布 Claude Code 插件 — 两大编程 Agent 工具链实现互联,热度 4.42,生态互操作成为趋势信号。原帖
- AI 编程时代「是否该读代码」的七级量表 — Matt Pocock 将争论从二选一拆解为连续谱,从「逐行审每个 diff」到「完全不读代码」七级,热度 4.86,折射出 AI 辅助编程进入新认知周期。原帖
- 开源 AI 渗透测试工具 Strix — GitHub 超 3.6 万星,覆盖漏洞挖掘、CTF、红队演练,热度 5.06,安全工具方向近期热度最高的开源项目。原帖
- Fable 5 自动化模板库发布 — 覆盖营销到编程的多场景自动化模板,热度 4.16,Fable 5 生态从「模型评测」向「可复用工作流」转型。原帖
模型
- GPT-5.6 Sol/Terra/Luna 发布,基准信息有限 — 5 帖聚簇、热度 5.98,仅公开单项行业基准,社区对实际水平看法分歧。原帖
- LongCat 2.0 开源(1.6T/48B,MIT) — 3 帖聚簇、热度 7.31,ModelScope 可下载,进入 LocalLLM 社区视野。原帖
- Fable 5 计费切换与用户流失信号 — 多帖印证按量计费倒计时,有用户两小时花掉 200 美元后转用 GPT 5.5,成本议题是今日 Fable 5 讨论主线。原帖
- Fable 5 实测:幻觉与「人成为决策瓶颈」 — Matt Pocock 报告十分钟内两次事实性幻觉(热度 5.08);另有观点认为 Fable 5 能力反而让人成为工作流中的短板(热度 3.68),两种视角并存。原帖
- 开源权重大模型长期前景存疑 — 社区讨论 Qwen 团队暂缓放出更大参数版本,开源模型落后 SOTA 约 2-4 个月,热度 5.10。原帖
多模态
漫话AGI
- 越来越多学生暑期选择做 AI 创业而非实习 — 热度 6.73 为频道日内最高,AI 浪潮对年轻人职业路径的重构在 Polymarket 引发观察讨论。原帖
- Garry Tan:AI 正让 40 岁有品味的创始人成为新一代独角兽 — YC 总裁认为 AI agents 与软件工厂可给个人创始人 100-1000 倍产能杠杆,热度 5.84。原帖
- Garry Tan:AI 将使全球人均 GDP 提升约 10 倍 — 创造价值的资本、人力、分发三大约束在 AI 时代趋近于零,热度 5.36。原帖
- fchollet:未来将出现「潜空间考古学家」 — 设想通过研究 21 世纪模型权重重建消亡文化,热度 5.38,模型权重作为数字遗产的哲学讨论。原帖
应用
安全
研究
具身
Infra
- ComfyUI 新增模型量化转换节点 — 支持 FP32/FP16/FP8/INT8/NVFP4/CONVROT 格式互转,2 帖聚簇、热度 5.11,本地部署精度调优门槛进一步降低。原帖
- GLM 5.2 在 AMD MI355X 实现单节点 2626 tok/s 推理 — 2 帖聚簇、热度 4.18,非 NVIDIA 硬件对主流开源模型的推理竞争力有具体数据支撑。原帖
- 康宁预测 2025-2028 年每年新增 AI 算力翻倍 — GPU 部署速率同步翻倍,热度 4.05,算力供给扩张预期维持乐观。原帖
- 扎克伯格透露 Meta 在建吉瓦级 AI 集群 — 热度 3.35,AI 基础设施军备竞赛规模持续升级。原帖
创投
Anthropic
OpenAI
Alibaba(阿里)
ByteDance
- Seedance 2.0 视频生成提示词在 X 与创作者社区广泛流通,4 帖聚簇、热度 5.82,是当日多模态频道热度最高的单一模型。原帖