用户自制基准实测:Astra 各档位质量缩水,额度砍至发布时十分之一
PM__me_sth · reddit · 2026-09-19
一位 Reddit 用户分享了自己维持两年的私有基准,并据此发现 Astra 各档位的质量明显下滑、可用额度大幅缩水:
- Astra Extra High:目前仅剩发布时额度的约 10%
- Astra High / Medium / Light:也都从发布时的 1 降到了 8-10(质量/额度损失约 10 倍量级)
他的基准很简单:60 句短句配 600 个视频文件,AI 需要提取视频的首/中/尾帧来判断匹配并自查,可检验多模态检索与判断的实际水平。
作者直言「OpenAI 这么干很过分」,并把这类私有基准当作检验服务商是否偷偷降质的工具。数据为个人实测,未经第三方验证。
「模型」频道最新
- LLM 下棋站更新:隐藏 AI 内部笔记防剧透,支持切换思考档 — MikePFrank · 2026-09-19
- 单卡 3090 实测 8 款视频 VLM:吞吐与首 token 延迟横向对比 — SkyLordOmega · 2026-09-19
- GLM 5.3 Flash 一把梭:直接用 Remotion 生成 60 秒股市动效视频 — 9r4n4y · 2026-09-19
- Jev 其实就是只输出一个 token 的 LLM:一篇原理拆解 — saurabhtwq · 2026-09-19
- 作家撰文讨论疑似 Claude Opus 5 的写作体验 — Sauers_ · 2026-09-19
- 研究者:LLM 聪明却不够敏锐,「敏锐度」可作进展新标尺 — jmugan · 2026-09-19