模型选择与能力对照
Grok 模型通常按推理能力、实时工具能力、多模态能力、速度和成本选择。实际可用模型名称以 Xikapi 后台模型列表和 xAI 官方模型列表为准,本文示例使用 xAI Responses API 的兼容调用方式。
新手先确认
Grok 示例走 OpenAI 兼容的 Responses API。新手排查时先确认地址、Key、模型名和工具能力,不要一开始就同时开启搜索、视觉和复杂推理。
| 要确认的内容 | 正确做法 | 常见误区 |
|---|---|---|
| API Key | 使用 Xikapi API Key | 填了 xAI 官方 Key,但 Base URL 写 Xikapi |
| Base URL | SDK 填 https://xikapi.com/v1 | 填成完整 /responses 路径 |
| 模型名 | 使用 Xikapi 后台启用的 Grok 模型 ID | 官方文档模型名和后台配置不一致 |
| 实时搜索 | 只在支持搜索的模型和接口上启用 | 普通文本请求里直接加搜索参数 |
| 超时 | 推理和搜索任务设置更长超时 | 默认短超时导致误判为模型不可用 |
常见模型类型
| 类型 | 适合场景 | 特点 |
|---|---|---|
| Grok 推理模型 | 复杂推理、高价值任务、深度分析 | 适合多步骤推理和复杂问题 |
| Grok 快速模型 | 日常生产、客服、代码解释、文档分析 | 速度、成本和质量均衡 |
| Grok 视觉模型 | 截图分析、图片问答、图表理解 | 支持图像输入 |
| Grok 工具模型 | 搜索、函数调用、代理型流程 | 适合连接外部工具和实时信息 |
按场景选择
| 场景 | 推荐模型类型 | 说明 |
|---|---|---|
| 普通聊天 | 快速模型 | 成本与速度均衡 |
| 复杂推理 | 推理模型 | 适合复杂、多步骤任务 |
| 实时信息问答 | 工具模型 + 搜索 | 适合新闻、网页、X 信息检索 |
| 长文档分析 | 推理模型 / 快速模型 | 关注上下文长度和稳定性 |
| 代码分析 | 推理模型 / 快速模型 | 适合代码解释、重构、审查 |
| 批量分类 | 快速模型 | 成本低、吞吐高 |
| 图像理解 | 视觉模型 | 适合截图、票据、图表分析 |
选择模型时关注什么
- 任务复杂度
- 输入长度
- 输出稳定性
- 成本预算
- 响应速度
- 是否需要实时搜索
- 是否需要图像理解
- 是否需要工具调用
基础调用示例
curl:
bash
curl https://xikapi.com/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XIKAPI_API_KEY" \
-d '{
"model": "grok-4.3-latest",
"input": [
{
"role": "user",
"content": "Explain in three sentences what Grok is best suited for"
}
]
}'JavaScript:
javascript
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XIKAPI_API_KEY,
baseURL: "https://xikapi.com/v1",
timeout: 360000,
});
const response = await client.responses.create({
model: "grok-4.3-latest",
input: [
{ role: "user", content: "Help me choose a Grok model for real-time information Q&A" }
],
});
console.log(response.output_text);Python:
python
from openai import OpenAI
client = OpenAI(
api_key="YOUR_XIKAPI_API_KEY",
base_url="https://xikapi.com/v1",
timeout=3600,
)
response = client.responses.create(
model="grok-4.3-latest",
input=[
{"role": "user", "content": "Help me choose a Grok model for document Q&A"}
],
)
print(response.output_text)常见排错
| 现象 | 优先检查 |
|---|---|
401 | 是否使用 Xikapi Key,Authorization Header 是否为 Bearer ... |
404 | baseURL 是否只到 /v1,SDK 是否自动拼接 /responses |
model not found | 后台是否启用该 Grok 模型,当前令牌是否允许调用 |
| 搜索结果为空 | 当前模型和接口是否支持搜索工具,搜索参数是否放在正确位置 |
| 请求超时 | 搜索和推理任务耗时更长,先增大 SDK timeout 再判断 |
| 图片请求失败 | 是否选择视觉模型,输入图片格式是否符合上游要求 |
推荐接入策略
- 普通聊天和客服优先使用快速模型
- 高价值复杂任务使用推理模型
- 需要最新信息时启用搜索工具
- 图像任务选择支持视觉输入的模型
- 生产环境准备主模型和降级模型
- 对批量任务分别记录模型、输入长度、输出长度和实际费用