幽默或是 LLM 最后短板,开发者问谁来建幽默基准
abhishekcode42 · x · 2026-09-13
作者提出:LLM 在几乎所有文字类技能上已超过普通人,幽默是仅剩的待攻克领域之一,并询问是否有人在为 LLM 建立幽默能力基准,以及还有哪些单一技能上模型仍不及普通人。
「模型」频道最新
- 热帖称定制开源模型成本仅前沿模型 5%,大厂护城河受质疑 — ayushtweetshere · 2026-09-13
- Abacus AI 发布 Smaug Mini 27B 开放权重,Flash 定价低至 $0.1/M — bindureddy · 2026-09-13
- 独立项目 AkbasCore 2.0:阻尼多轴激活转向内核在 Qwen2.5-7B 上验证 — Nearby_Indication474 · 2026-09-13
- Astra 发布十天:开发者实测称 CUA/视觉大进步,但无智能跃迁 — tokenbender · 2026-09-13
- Astra 高推理档 ARC-AGI-3 更强,成本反而省 46% — daniel_mac8 · 2026-09-13
- DeepSeek v4.1 flash 缓存命中率惊人,超长会话下成本优势凸显 — teortaxesTex · 2026-09-13