Skip to main content
Google Gemini 是一个非常强大的 AI 对话系统,通过输入提示就能在几秒内生成流畅自然的回复。本文档主要描述 Gemini Generate Content API 的使用方法,这是 Google 官方原生 API 格式,支持 generateContentstreamGenerateContent 两个端点。

与 Chat Completions API 的区别

Gemini Generate Content API 使用 Google 官方原生请求格式(contents 字段),而不是 OpenAI 兼容格式(messages 字段)。如果你已经使用 Google Gemini SDK 或熟悉官方 API 格式,可以直接使用此 API 而无需修改请求格式。

申请流程

使用 Gemini Generate Content API 前,请先访问 Gemini Generate Content API 页面,点击 “获取” 按钮来获得请求所需的凭证。 如果尚未登录或注册,会自动跳转到登录页面。首次申请会有免费额度。

基本用法

Non-Streaming(非流式)

发送 POST 请求到 /v1beta/models/{model}:generateContent
提示gemini-3.x 系列 flash 为思考模型,会先消耗 reasoning tokens;请把 generationConfig.maxOutputTokens 设到 512 以上,否则可能只返回空内容。
返回结果示例:

Streaming(流式)

发送 POST 请求到 /v1beta/models/{model}:streamGenerateContent?alt=sse
流式返回会以 SSE(Server-Sent Events)格式逐步返回内容。

支持的模型

高级功能

系统指令

生成配置

JSON 模式

思考模式(Thinking)

支持思考功能的模型(如 gemini-2.5-flash、gemini-2.5-pro)可以启用思考模式:

函数调用

多轮对话

图片理解

安全设置

可通过 safetySettings 控制内容过滤:

错误处理