测试 Gemini 3.1 Pro 识别柔道投技的效果
Hour-Wish8158 · reddit · 2026-09-01
作者正在构建一个项目,用于评估视觉-语言模型(VLM)在分类格斗技术(如柔道投技)方面的表现。目前的测试结果显示,使用未经微调的原始模型(Vanilla models)进行识别时,结果有些不稳定,准确性时好时坏。作者认为如果有足够的数据进行微调,准确率应该会有显著提升。如果社区中有从事工程工作的柔道爱好者感兴趣,作者愿意将该工具开源。
「模型」频道最新
- OpenRouter 上线 262K 上下文金融模型 LING 3.0 — Daikon-Legend · 2026-09-01
- ChatGPT 谈《权力的游戏》时触发安全警告 — thecowmilk_ · 2026-09-01
- GLM-5.3 登 Vals 榜开源第二:法律研究、代码迁移拿下第一 — AccBalanced · 2026-09-01
- 开源前沿与闭源前沿的较量:Claude 3 Opus 击败众模型登顶生物基准 — zainhas · 2026-09-01
- 探讨模型“循环利用”与分层蒸馏的可行性 — TomLucidor · 2026-09-01
- Claude iOS 版新增警示:Max 模式消耗 1.5 倍额度 — testingcatalog · 2026-09-01