Skip to main content
Gemini 原生文档理解适合合同摘要、简历解析、报告问答、发票/表格信息提取、知识库文档预审等场景。原生格式可以把文档作为 parts 中的文件片段传入,并用文本指令明确需要总结、抽取、分类还是问答。
联调、小文件和客户本地文件推荐优先使用 inlineData,这是最不依赖外部下载环境的方式。公网 URL 也可以使用 fileData.fileUri,但必须确保它是上游可直接读取、返回真实文件 MIME 类型的直链;HTTP 请求被接受不等于模型已经读到正文。

接口地址

非流式:
流式:
示例模型:

鉴权

推荐:
兼容:

支持的输入方式

常见 MIME 类型:
fileUri 必须是上游模型可匿名访问的文件直链,并且下载响应的 Content-Type 要与 mimeType 一致。不要传本地路径、内网地址、需要登录 Cookie 的下载页、短时间过期链接、HTML 预览页或会跳转到网页的地址。若客户无法确认 URL 一定可被上游读取,请使用 inlineData

使用 Base64 内联文件

小文件可以直接用 inlineData 传入。data 字段只放 Base64 内容,不要包含 data:application/pdf;base64, 前缀。

curl

请求体

响应示例

使用公网 PDF URL

如果文件已经在客户对象存储或 CDN 中,并且可以被上游模型匿名下载,可以使用 fileData.fileUri。请先用一个“是否读到正文”的探针请求验证 URL 真的被模型读取,而不是只被网关接受。
如果响应内容为 DOC_URL_SEEN=NO、模型只复述 URL、或者错误提示上游下载到 text/html,说明这个 URL 不是可用的文档直链。请改用 inlineData,或把文件转存到返回正确 application/pdf 的稳定直链。

流式文档理解

文档较大时,流式输出可以更早让客户看到摘要片段。
响应为 SSE:

结构化抽取示例

配合 responseMimeType: "application/json",可以让模型按固定字段返回。

Python 示例

JavaScript 示例

最佳实践

常见问题