模型选择与能力对照
Gemini 模型通常按能力、速度、成本和上下文长度选择。实际可用模型名称以 Xikapi 后台模型列表和 Google 官方模型列表为准,本文示例使用 Gemini API 的兼容调用方式。
新手先确认
Gemini 示例使用 Google Gemini 的 generateContent 风格路径。它和 OpenAI Chat Completions 不是同一种请求格式:
text
https://xikapi.com/v1beta/models/{model}:generateContent如果你的工具只能配置 OpenAI 兼容接口,请优先选择工具文档里的 Xikapi 配置方式;如果使用 Google GenAI SDK,再参考本页示例。
| 要确认的内容 | 正确做法 | 常见误区 |
|---|---|---|
| API Key | 使用 Xikapi API Key | 把 Google AI Studio Key 填到 Xikapi 地址里 |
| Base URL | Google GenAI SDK 填 https://xikapi.com | 填成 https://xikapi.com/v1 导致路径重复或不匹配 |
| 模型名 | 使用后台启用的 Gemini 模型 ID | 示例模型名未在后台启用 |
| 请求格式 | Gemini 使用 contents 和 parts | 直接发送 OpenAI 的 messages |
| 图片输入 | 使用支持视觉的 Gemini 模型 | 用不支持视觉输入的模型传图片 |
常见模型类型
| 类型 | 适合场景 | 特点 |
|---|---|---|
| Gemini Pro | 复杂推理、深度分析、复杂代码任务 | 能力强,适合高价值任务 |
| Gemini Flash | 日常生产、客服、文档问答、代码解释 | 速度、成本和质量均衡 |
| Gemini Flash-Lite | 批量分类、简单抽取、低成本任务 | 成本低,响应快 |
| Gemini 图像/多模态模型 | 图片问答、截图分析、图表理解 | 支持文本和图像等多模态输入 |
按场景选择
| 场景 | 推荐模型类型 | 说明 |
|---|---|---|
| 普通聊天 | Flash / Flash-Lite | 成本与速度均衡 |
| 复杂推理 | Pro / Flash | 适合多步骤分析 |
| 长文档分析 | Pro / Flash | 关注上下文长度和稳定性 |
| 代码分析 | Pro / Flash | 适合解释、重构、审查 |
| 批量分类 | Flash-Lite | 成本低、吞吐高 |
| 企业客服 | Flash | 质量、成本和延迟均衡 |
| 图像理解 | Pro / Flash | 适合截图、票据和图表分析 |
选择模型时关注什么
- 任务复杂度
- 输入长度
- 输出稳定性
- 成本预算
- 响应速度
- 是否需要图像理解
- 是否需要函数调用
- 是否需要结构化输出
基础调用示例
curl:
bash
curl "https://xikapi.com/v1beta/models/gemini-3.5-flash:generateContent?key=$XIKAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [
{
"parts": [
{ "text": "Explain in three sentences what Gemini Flash is best suited for" }
]
}
]
}'JavaScript:
javascript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({
apiKey: process.env.XIKAPI_API_KEY,
httpOptions: {
baseUrl: "https://xikapi.com"
}
});
const response = await ai.models.generateContent({
model: "gemini-3.5-flash",
contents: "Help me choose a Gemini model for customer support"
});
console.log(response.text);Python:
python
from google import genai
from google.genai import types
client = genai.Client(
api_key="YOUR_XIKAPI_API_KEY",
http_options=types.HttpOptions(base_url="https://xikapi.com"),
)
response = client.models.generate_content(
model="gemini-3.5-flash",
contents="Help me choose a Gemini model for document Q&A",
)
print(response.text)常见排错
| 现象 | 优先检查 |
|---|---|
API key not valid | 是否使用 Xikapi Key,URL 查询参数是否为 key=$XIKAPI_API_KEY |
404 | baseUrl 是否只写 https://xikapi.com,路径里是否包含正确的 v1beta/models/...:generateContent |
model not found | Xikapi 后台是否启用了该 Gemini 模型,模型 ID 是否和后台完全一致 |
contents 或 parts 报错 | 是否误用了 OpenAI 的 messages 格式 |
| 图片输入失败 | 模型是否支持视觉,图片是否按 Gemini SDK 要求传入 |
| 输出被截断 | 设置更大的输出上限,或把长任务拆成多轮处理 |
推荐接入策略
- 简单任务优先使用 Flash-Lite
- 大多数生产任务优先使用 Flash
- 高价值复杂任务使用 Pro
- 图像任务选择支持视觉输入的模型
- 生产环境准备主模型和降级模型
- 对批量任务分别记录模型、输入长度、输出长度和实际费用