Moda 周报:自定义分类器以 1/30 成本超越 Opus 5.5 做用户挫败检测
KlausCodes · x · 2026-09-29
AI 可观测性初创 Moda 发布第二期周报,聚焦「发现问题之后如何处置」:
- Linear 集成:一键把检测到的问题发到 Linear,支持自动同步生成 issue,可 @Moda 跟踪修复进度。
- 挫败感检测:用户很少直说不满,而是重复、换说法或默默放弃。团队手工标注了 1000+ 轮对话并自建 benchmark,生产系统在挫败检测上以约 1/30 的成本超过 Opus 5.5。
- 区分转向与负面:「不是这个」「这些都不喜欢」属于引导 agent 而非不满,新归为 Redirection,与负面情绪分开统计。
- 自定义信号面向所有团队开放;误报可一键标记,系统据此学习;打开 trace 时会高亮关联消息。
「编程与Agent」频道最新
- 资深工程师 TL 两极化:年作资产被做成 skills vs 按次生成单测 — vboykis · 2026-09-29
- 90 分钟 70 万 token,Claude 写出可交互核电站仿真模型 — aran_nayebi · 2026-09-29
- ProgramBench 多智能体实测:Opus 5.5 用 5 个 agent 跑最快 — jyangballin · 2026-09-29
- exe.dev 取消按席位计费:企业改按算力池付费,个人版降至 $15/月 — davidcrawshaw · 2026-09-29
- Hedryn 开源在即:让项目而非聊天窗口拥有 AI 上下文 — mb_builds · 2026-09-29
- 机器学习名家:问 LLM 要方案常过度设计,一句「fix it」反而更好 — burkov · 2026-09-29