Gemini API 原生支持 PDF 理解,可读取图表与手写内容
Google AI Studio 宣布 Gemini API 原生支持 PDF 理解,可处理 PDF 中内嵌的图片、图表与手写内容,并支持多语言,用法是上传文件后直接提示即可。Google 开发者倡导者还实测演示了 Gemini 直接读取论文 PDF 中的图表,反向复刻论文原图,验证了该能力在科研场景的可行性。
2026-09-25 ~ 2026-09-25 · 2 条相关
- Google AI Studio 的 Gemini API 原生支持 PDF 理解,含图表与手写体 — DynamicWebPaige · 2026-09-25
- Gemini 可直接读取 PDF 中的图表,反向复刻论文原图实测可行 — DynamicWebPaige · 2026-09-25