模型选择与能力对照
ChatGLM / GLM 模型覆盖通用文本、复杂推理、低延迟、视觉和工具调用等任务。实际可用模型以 Xikapi 后台模型列表为准。
新手先确认
ChatGLM / GLM 在 Xikapi 中通常按 OpenAI 兼容 Chat Completions 调用。先用文本模型确认连通性,再测试视觉、工具调用和推理能力。
| 要确认的内容 | 正确做法 | 常见误区 |
|---|---|---|
| Base URL | SDK 填 https://xikapi.com/v1 | 填成完整 /chat/completions |
| API Key | 使用 Xikapi API Key | 使用智谱官方 Key 调 Xikapi 地址 |
| 模型名 | 使用 Xikapi 后台启用的 GLM 模型 ID | 把展示名当成模型 ID |
| 视觉能力 | 选择 GLM-V 类模型 | 普通 GLM 文本模型直接传图片 |
| 低延迟 | 优先测试 turbo / flash 类模型 | 所有请求都默认使用旗舰模型 |
常见模型
| 模型 | 适合场景 | 说明 |
|---|---|---|
glm-5.1-air | 通用问答、写作、总结、复杂任务 | 当前推荐对话模型 |
glm-5-flash | 低延迟生产任务 | 速度和成本更友好 |
glm-5 | 复杂推理、长上下文 | GLM-5 系列通用能力 |
glm-4.7 / glm-4.6 | 通用问答、代码、分析 | 旧一代高能力模型 |
glm-4.7-flash / glm-4.5-flash | 快速响应、批量任务 | 成本和延迟友好 |
glm-5v / glm-4v 系列 | 图像理解 | 适合截图、票据、图表分析 |
按场景选择
| 场景 | 推荐模型 | 说明 |
|---|---|---|
| 普通聊天 | glm-5.1-air / glm-5-flash | 按质量和延迟选择 |
| 批量分类 | flash / turbo 模型 | 成本和速度友好 |
| 复杂推理 | GLM-5 系列 | 适合多步骤分析 |
| 图像理解 | GLM-V 系列 | 需要视觉输入能力 |
| 中文客服 | glm-5.1-air / glm-5-flash | 中文场景友好 |
后台字段建议
| 字段 | 建议值 |
|---|---|
| 供应商 | ChatGLM / 智谱 AI |
| 模型类型 | 文本、推理、图像理解、工具调用 |
| 标签 | 中文优化、低延迟、强推理、视觉、低成本 |
| 可用令牌分组 | 默认开放通用模型,高级分组开放旗舰和视觉模型 |
| 计费类型 | 通常按输入和输出 token 计费,视觉等能力可能有不同规则 |
推荐接入策略
- 中文问答和客服优先测试
glm-5.1-air或glm-5-flash - 复杂推理任务测试 GLM-5 系列
- 视觉任务选择 GLM-V 系列
- 高成本模型放入受控令牌分组
常见排错
| 现象 | 优先检查 |
|---|---|
401 | 是否使用 Xikapi Key,Authorization Header 是否正确 |
404 | Base URL 是否为 https://xikapi.com/v1 |
model not found | 模型是否已在 Xikapi 后台启用,ID 是否和后台一致 |
| 图片无法识别 | 是否使用 GLM-V 类视觉模型,图片格式是否符合接口要求 |
| 延迟过高 | 是否误用旗舰或推理模型,是否应切换 turbo / flash |
| 工具调用异常 | 当前模型是否支持工具调用,先用普通文本请求验证连通性 |