内部人士:Gemini 3.8 live 部分基准已胜过 gpt-live-1
bosmeny · x · 2026-09-18
Bek Abdikov 评价 Google 的 Gemini 3.8 live 是「野兽级」且被低估,称其部分自家基准测试中击败了 gpt-live-1。OpenAI 前早期成员 Steve Bosmeny 转发表示:「如果 Bek 说一个语音模型好,那它一定好」——暗示 Bek 的判断在该圈子内有分量。属圈内人士对实时语音模型格局的非正式评价。
「模型」频道最新
- 腾讯 Hy4 Preview 位列开源模型第四,最便宜且三项 agent 榜第一 — mariofilhoml · 2026-09-18
- 计数字母暴露短板:GPT-6-Astra 93% 对手惨败 — scaling01 · 2026-09-18
- Typesafe 推出 Jev 模型:不做文本生成,直接输出带概率的类型化决策 — majidmanzarpour · 2026-09-18
- 智谱 AI 自主发现可被 WeWorm 利用的安全漏洞,引关注 — teortaxesTex · 2026-09-18
- 用户实测:保险法律问题 Gemini 一遍答对,ChatGPT 循环诡辩 — Hatrct · 2026-09-18
- Typesafe AI 发布分类模型 Jev,成本较同类 LLM 最多降 400 倍 — hwchase17 · 2026-09-18