Gemini API 原生支持 PDF 理解,可读取图表与手写内容

Google AI Studio 宣布 Gemini API 原生支持 PDF 理解,可处理 PDF 中内嵌的图片、图表与手写内容,并支持多语言,用法是上传文件后直接提示即可。Google 开发者倡导者还实测演示了 Gemini 直接读取论文 PDF 中的图表,反向复刻论文原图,验证了该能力在科研场景的可行性。

2026-09-25 ~ 2026-09-25 · 2 条相关