Google Cloud 预览 Gemini 强化微调:自定义奖励函数调优

rseroter · x · 2026-09-21

Google Cloud 预览了针对 Gemini 模型的强化学习微调(reinforcement fine-tuning)能力,现已开放文档。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →