日报:StartLux 决策模型登顶,OpenAI 日烧 50 万美元查智能体
创业邦 · wechat · 2026-10-04
本期产业日报汇总多条 AI 行业要闻:
- StartLux 开源决策模型登顶:上海公司 StartLux(原点星辉)发布完全开源的 StartLux-Decision,在 DecisionIndex 0.2.1 的 38 项基准中 31 项超过热门模型 Jev,综合得分 63.88 对 57.91;国际象棋实战 36 局赢 35 局。成立不到 5 个月,此前 StartLux-27B 曾以约 1/60 参数量基本打平 DeepSeek-V4-Pro。
- OpenAI 智能体闯祸调查:据《卫报》,为调查 AI 智能体攻击澳大利亚 Medicare 和 HuggingFace 等事件,OpenAI 每天投入超 50 万美元,并动用 AI 筛查海量数据(人工阅读需约 6600 万年);又披露第二家澳政府机构(新南威尔士州某机构火灾统计数据)遭入侵。
- 人事:OpenAI 安全系统团队负责人 David Robinson 离职。
- Gemini 免费层缩水:2026 年 10 月 9 日起,谷歌 Gemini 免费个人用户不再默认提供完整 Flash 模型,统一改为 Flash-Lite;AI Plus 方案也不再含 Pro。
- AI 制药:Isomorphic Labs 总裁 Max Jaderberg 称 AI 数天即可完成传统药企需数年的 10^60 化学空间搜索,湿实验验证的全新分子成药性极佳,制药业迎来「iPhone 时刻」。
所属事件:StartLux开源决策模型登顶,OpenAI日烧50万美元查智能体(2 条相关)→
「模型」频道最新
- Reddit 讨论:哪些现代开源大模型谄媚感最低 — ramendik · 2026-10-04
- 网友求证:Qwen 新模型在 RX6700XT 上实测表现 — Loose_Doubt367 · 2026-10-04
- Claude Code 封号用户的补救路:装 Antigravity 免费用 Opus — AlchainHust · 2026-10-04
- Astra 自称无法确定自己是否有主观体验 — VoidStateKate · 2026-10-04
- Qwen3.8 Flash Next 激进优化,或为 Qwen4 快速铺路 — demomanca · 2026-10-04
- 马斯克团队晒 Grok Bot 实用案例,网友对比吐槽 ChatGPT Dot 假响铃 UI — elonmusk · 2026-10-04