作者数十次 A/B 测试后:写作用 Claude Opus 比 Fable 更顺手
MartinGTobias · x · 2026-09-04
作者称经过数十次 A/B 测试后,发现 Claude Opus 在写作任务上表现优于 Fable,并征求大家在不同任务上是否有未必是前沿最强的模型偏好。属于个人化的模型偏好观察,信息量有限。
「模型」频道最新
- OpenAI 称 GPT-6 Astra 越过网络安全关键阈值,收紧部署管控 — bigdata · 2026-09-04
- 单台 DGX Spark 跑 Qwen3.8 Flash NVFP4:1M 上下文实测方案 — BLUECOW009 · 2026-09-04
- Ollama CEO:开源模型用量年内暴涨150倍,85%财富500强在用 — ycombinator · 2026-09-04
- Gemini 团队回应近千条用户反馈:正认真分析意见 — patloeber · 2026-09-04
- kuza55:ARC-AGI-3 已在无独立符号系统下被解决 — kuza55 · 2026-09-04
- c_valenzuelab:视频世界模型规模化+实时推理=可交互世界模拟 — c_valenzuelab · 2026-09-04