EEBench 对比引热议:Grok 4.7 被指产出“无法审查的电路垃圾”
teortaxesTex · x · 2026-09-22
转发内容围绕 Grok 4.7 在电子设计基准 EEBench 上的表现:发帖人称 EEBench 用 Atopile 工具生成的输出是“无法审查的垃圾”,而真正的模型应能配合 Backplane 等工具产出可用的原理图;并称 Astra 在每任务的时间和成本上大幅领先所有其他模型。属于第三方对模型能力的争议性对比说法,未经官方证实。
「模型」频道最新
- Limite 发布 1B 数学小模型:参数仅 10 亿,数据不到 300B token — tensorqt · 2026-09-22
- 顶级开源模型后训练成本仅 350 万美元,远低于前沿实验室投入 — Kyrannio · 2026-09-22
- 37 项基准、每模型 13 万次决策:jeff 擅长工具与自动化任务 — multimodalart · 2026-09-22
- 37 项基准 13 万次决策:单卡 RTX 6000 Pro 实测本地模型排行 — multimodalart · 2026-09-22
- Decision Index 0.1 发布:向每个模型提问 13 万次横评 30+ 决策模型 — multimodalart · 2026-09-22
- 小米发布 MiMo-V2.6-Distill-Qwen-9B:9B 智能体专用蒸馏模型 — anovers · 2026-09-22