H3 模型训练困难,社区呼吁发布基座版
crinklypaper · reddit · 2026-08-17
用户反馈 H3 模型虽然生成质量好,但在微调训练方面表现糟糕,效果远不如预期。目前的蒸馏版模型难以注入新概念,仅能勉强训练角色 LoRA。社区呼吁官方发布适合训练的基座模型。
「模型」频道最新
- 传 OpenAI 预告新模型 Astra,或于月底发布 — haider1 · 2026-08-17
- 开发者评 OpenAI 1M 上下文:无缝压缩是关键 — eyishazyer · 2026-08-17
- 用户反馈 Qwen 模型过度思考:回复 Hi 耗时 23 秒 — malliktwts · 2026-08-17
- Qwen 3.8 与 DeepSeek 4 本地实测:质量显著跃升 — olcan · 2026-08-17
- Sarvam AI 发布 105B 语音模型与全栈 Agent 方案 — AashaySachdeva · 2026-08-17
- 实测 GPT-4o Pro 连续运行突破 2 小时 — banteg · 2026-08-17