/gemini/v1beta/models/{model}:generateContentGemini 非流式内容生成。Gateway 将 URL 中的公开模型改写为 LiteLLM model_name;具体协议兼容和可调用 Deployment 由 LiteLLM 决定。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| contents | object[] | 必填 | 对话内容数组。 |
| role | string | 可选 | 角色,可选 "user" 或 "model"。 |
| parts | object[] | 必填 | 内容片段数组。 |
| text | string | 可选 | 文本内容。 |
| generationConfig | object | 可选 | 生成配置。 |
| temperature | number | 可选 | 采样温度。 |
| topP | number | 可选 | 核采样参数。 |
| topK | number | 可选 | Top-K 采样参数。 |
| maxOutputTokens | number | 可选 | 最大输出 token 数。 |
| stopSequences | string[] | 可选 | 停止序列。 |
| safetySettings | object[] | 可选 | 安全设置,控制内容过滤级别。 |
import { GoogleGenAI } from "@google/genai"
// SDK 默认把 apiKey 发在 x-goog-api-key(网关只读 Authorization),
// 必须用 httpOptions.headers 显式补 Authorization: Bearer <key>。
const ai = new GoogleGenAI({
apiKey: "gw_memene_<keyId>_<secret>",
httpOptions: {
baseUrl: "https://llmapi.memene.cn/gemini",
headers: { Authorization: "Bearer gw_memene_<keyId>_<secret>" },
},
})
const res = await ai.models.generateContent({
model: "gemini-2.5-flash",
contents: "Explain quantum computing in simple terms.",
config: { temperature: 0.7, maxOutputTokens: 1024 },
})
console.log(res.text){
"candidates": [
{
"content": {
"parts": [
{
"text": "Quantum computing uses quantum bits (qubits) that can exist in multiple states simultaneously..."
}
],
"role": "model"
},
"finishReason": "STOP"
}
],
"usageMetadata": {
"promptTokenCount": 8,
"candidatesTokenCount": 42,
"totalTokenCount": 50
}
}注意:URL 中的 {model} 为模型名称(如 gemini-2.0-flash)。完整路径示例:`/gemini/v1beta/models/gemini-2.0-flash:generateContent`