generateContent 和 streamGenerateContent 两个端点。
与 Chat Completions API 的区别
Gemini Generate Content API 使用 Google 官方原生请求格式(contents 字段),而不是 OpenAI 兼容格式(messages 字段)。如果你已经使用 Google Gemini SDK 或熟悉官方 API 格式,可以直接使用此 API 而无需修改请求格式。
申请流程
使用 Gemini Generate Content API 前,请先访问 Gemini Generate Content API 页面,点击 “获取” 按钮来获得请求所需的凭证。 如果尚未登录或注册,会自动跳转到登录页面。首次申请会有免费额度。基本用法
Non-Streaming(非流式)
发送 POST 请求到/v1beta/models/{model}:generateContent:
提示:gemini-3.x系列 flash 为思考模型,会先消耗 reasoning tokens;请把generationConfig.maxOutputTokens设到 512 以上,否则可能只返回空内容。
Streaming(流式)
发送 POST 请求到/v1beta/models/{model}:streamGenerateContent?alt=sse:
支持的模型
高级功能
系统指令
生成配置
JSON 模式
思考模式(Thinking)
支持思考功能的模型(如 gemini-2.5-flash、gemini-2.5-pro)可以启用思考模式:函数调用
多轮对话
图片理解
安全设置
可通过safetySettings 控制内容过滤:

