Skip to content

模型选择与能力对照

Gemini 模型通常按能力、速度、成本和上下文长度选择。实际可用模型名称以 Xikapi 后台模型列表和 Google 官方模型列表为准,本文示例使用 Gemini API 的兼容调用方式。

新手先确认

Gemini 示例使用 Google Gemini 的 generateContent 风格路径。它和 OpenAI Chat Completions 不是同一种请求格式:

text
https://xikapi.com/v1beta/models/{model}:generateContent

如果你的工具只能配置 OpenAI 兼容接口,请优先选择工具文档里的 Xikapi 配置方式;如果使用 Google GenAI SDK,再参考本页示例。

要确认的内容正确做法常见误区
API Key使用 Xikapi API Key把 Google AI Studio Key 填到 Xikapi 地址里
Base URLGoogle GenAI SDK 填 https://xikapi.com填成 https://xikapi.com/v1 导致路径重复或不匹配
模型名使用后台启用的 Gemini 模型 ID示例模型名未在后台启用
请求格式Gemini 使用 contentsparts直接发送 OpenAI 的 messages
图片输入使用支持视觉的 Gemini 模型用不支持视觉输入的模型传图片

常见模型类型

类型适合场景特点
Gemini Pro复杂推理、深度分析、复杂代码任务能力强,适合高价值任务
Gemini Flash日常生产、客服、文档问答、代码解释速度、成本和质量均衡
Gemini Flash-Lite批量分类、简单抽取、低成本任务成本低,响应快
Gemini 图像/多模态模型图片问答、截图分析、图表理解支持文本和图像等多模态输入

按场景选择

场景推荐模型类型说明
普通聊天Flash / Flash-Lite成本与速度均衡
复杂推理Pro / Flash适合多步骤分析
长文档分析Pro / Flash关注上下文长度和稳定性
代码分析Pro / Flash适合解释、重构、审查
批量分类Flash-Lite成本低、吞吐高
企业客服Flash质量、成本和延迟均衡
图像理解Pro / Flash适合截图、票据和图表分析

选择模型时关注什么

  • 任务复杂度
  • 输入长度
  • 输出稳定性
  • 成本预算
  • 响应速度
  • 是否需要图像理解
  • 是否需要函数调用
  • 是否需要结构化输出

基础调用示例

curl:

bash
curl "https://xikapi.com/v1beta/models/gemini-3.5-flash:generateContent?key=$XIKAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {
        "parts": [
          { "text": "Explain in three sentences what Gemini Flash is best suited for" }
        ]
      }
    ]
  }'

JavaScript:

javascript
import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({
  apiKey: process.env.XIKAPI_API_KEY,
  httpOptions: {
    baseUrl: "https://xikapi.com"
  }
});

const response = await ai.models.generateContent({
  model: "gemini-3.5-flash",
  contents: "Help me choose a Gemini model for customer support"
});

console.log(response.text);

Python:

python
from google import genai
from google.genai import types

client = genai.Client(
    api_key="YOUR_XIKAPI_API_KEY",
    http_options=types.HttpOptions(base_url="https://xikapi.com"),
)

response = client.models.generate_content(
    model="gemini-3.5-flash",
    contents="Help me choose a Gemini model for document Q&A",
)

print(response.text)

常见排错

现象优先检查
API key not valid是否使用 Xikapi Key,URL 查询参数是否为 key=$XIKAPI_API_KEY
404baseUrl 是否只写 https://xikapi.com,路径里是否包含正确的 v1beta/models/...:generateContent
model not foundXikapi 后台是否启用了该 Gemini 模型,模型 ID 是否和后台完全一致
contentsparts 报错是否误用了 OpenAI 的 messages 格式
图片输入失败模型是否支持视觉,图片是否按 Gemini SDK 要求传入
输出被截断设置更大的输出上限,或把长任务拆成多轮处理

推荐接入策略

  • 简单任务优先使用 Flash-Lite
  • 大多数生产任务优先使用 Flash
  • 高价值复杂任务使用 Pro
  • 图像任务选择支持视觉输入的模型
  • 生产环境准备主模型和降级模型
  • 对批量任务分别记录模型、输入长度、输出长度和实际费用