Gateway API 文档

Google Gemini
POST/gemini/v1beta/models/{model}:generateContent

Generate Content

Gemini 非流式内容生成。Gateway 将 URL 中的公开模型改写为 LiteLLM model_name;具体协议兼容和可调用 Deployment 由 LiteLLM 决定。

需要认证

请求参数

参数类型必填说明
contentsobject[]必填对话内容数组。
rolestring可选角色,可选 "user" 或 "model"。
partsobject[]必填内容片段数组。
textstring可选文本内容。
generationConfigobject可选生成配置。
temperaturenumber可选采样温度。
topPnumber可选核采样参数。
topKnumber可选Top-K 采样参数。
maxOutputTokensnumber可选最大输出 token 数。
stopSequencesstring[]可选停止序列。
safetySettingsobject[]可选安全设置,控制内容过滤级别。

调用示例

typescript
import { GoogleGenAI } from "@google/genai"

// SDK 默认把 apiKey 发在 x-goog-api-key(网关只读 Authorization),
// 必须用 httpOptions.headers 显式补 Authorization: Bearer <key>。
const ai = new GoogleGenAI({
  apiKey: "gw_memene_<keyId>_<secret>",
  httpOptions: {
    baseUrl: "https://llmapi.memene.cn/gemini",
    headers: { Authorization: "Bearer gw_memene_<keyId>_<secret>" },
  },
})

const res = await ai.models.generateContent({
  model: "gemini-2.5-flash",
  contents: "Explain quantum computing in simple terms.",
  config: { temperature: 0.7, maxOutputTokens: 1024 },
})
console.log(res.text)

响应示例

json
{
  "candidates": [
    {
      "content": {
        "parts": [
          {
            "text": "Quantum computing uses quantum bits (qubits) that can exist in multiple states simultaneously..."
          }
        ],
        "role": "model"
      },
      "finishReason": "STOP"
    }
  ],
  "usageMetadata": {
    "promptTokenCount": 8,
    "candidatesTokenCount": 42,
    "totalTokenCount": 50
  }
}

注意:URL 中的 {model} 为模型名称(如 gemini-2.0-flash)。完整路径示例:`/gemini/v1beta/models/gemini-2.0-flash:generateContent`