用 Gradio 把 4B 小模型微调成答案打分器,温度缩放校准置信度
Gradio · x · 2026-09-18
作者 @evilpingwin 分享了自己在 Hugging Chat 上用 ML Intern agent(配合 Gradio)做的一个实验:把 Qwen3.5-4B 微调成一个「决策打分器」——给定上下文、问题和候选答案,模型对每个答案打分。
推理侧的关键一步是用 temperature scaling 对输出概率做校准,让模型的置信度更真实地反映其正确率。作者强调推理配置占了一半工作量,并附上了 Gradio demo 链接。
这是「用 agent 帮自己搭模型流水线」的一个具体案例:小模型 + 概率校准做答案评估,而非直接生成答案。
「编程与Agent」频道最新
- LangChain 释出 Jev 构建 Agent Harness 教程,专攻受限输出 — multiply_matrix · 2026-09-18
- NewEyes AI 登陆 Meta 眼镜:本地轻处理+云端深推理分工 — rohanpaul_ai · 2026-09-18
- Cursor Projects 多模型编排获好评:看板追踪+三模型方案对决 — kieranklaassen · 2026-09-18
- AI 咨询公司 Hang Ten 获 5300 万美元种子轮,总融资达 8500 万 — vsikka · 2026-09-18
- AI 编程会变多人游戏吗:Slack 共享智能体 vs 各自为战的单人增强 — Telos_in_the_Void · 2026-09-18
- Skillry 上线:给 Claude Code 等 Agent 加「审美」的技能库 — yihui_indie · 2026-09-18