谷歌高管:新版 Gemini 发布前经数千名 SWE 数周实测
inductionheads · x · 2026-10-01
Google DeepMind 工程负责人 Logan Kilpatrick 回应质疑称,Google 现在已能在大规模范围内更好地测试模型:大多数新版本 Gemini 在发布前会经过数千名软件工程师持续数周的内部使用检验。他表示这有望实质性缩小「基准测试成绩与真实体验」之间的差距。
「公司和人」频道最新
- 曝 xAI 内部用 Grok Bot 智能体开发 Grok Bot:设计、编码、测试全自动化 — elonmusk · 2026-10-01
- Sakana AI 招聘首位产品销售,要为零建企业 GTM 体系 — SakanaAILabs · 2026-10-01
- 企业 AI 的下一步:更强模型还是更深接入业务数据? — EmotionNegative6103 · 2026-10-01
- Remi Louf:写代码门槛降了,识别真问题成了稀缺能力 — remilouf · 2026-10-01
- Greg Brockman 自称不再亲手写代码:AI 已能完成执行工作 — Olivier__OG · 2026-10-01
- RLHF 论文合著者 Diogo Almeida 分享 TypeSafe Jev 模型背后的理念 — AxSaucedo · 2026-10-01