Skip to content

模型选择与能力对照

ChatGLM / GLM 模型覆盖通用文本、复杂推理、低延迟、视觉和工具调用等任务。实际可用模型以 Xikapi 后台模型列表为准。

新手先确认

ChatGLM / GLM 在 Xikapi 中通常按 OpenAI 兼容 Chat Completions 调用。先用文本模型确认连通性,再测试视觉、工具调用和推理能力。

要确认的内容正确做法常见误区
Base URLSDK 填 https://xikapi.com/v1填成完整 /chat/completions
API Key使用 Xikapi API Key使用智谱官方 Key 调 Xikapi 地址
模型名使用 Xikapi 后台启用的 GLM 模型 ID把展示名当成模型 ID
视觉能力选择 GLM-V 类模型普通 GLM 文本模型直接传图片
低延迟优先测试 turbo / flash 类模型所有请求都默认使用旗舰模型

常见模型

模型适合场景说明
glm-5.1-air通用问答、写作、总结、复杂任务当前推荐对话模型
glm-5-flash低延迟生产任务速度和成本更友好
glm-5复杂推理、长上下文GLM-5 系列通用能力
glm-4.7 / glm-4.6通用问答、代码、分析旧一代高能力模型
glm-4.7-flash / glm-4.5-flash快速响应、批量任务成本和延迟友好
glm-5v / glm-4v 系列图像理解适合截图、票据、图表分析

按场景选择

场景推荐模型说明
普通聊天glm-5.1-air / glm-5-flash按质量和延迟选择
批量分类flash / turbo 模型成本和速度友好
复杂推理GLM-5 系列适合多步骤分析
图像理解GLM-V 系列需要视觉输入能力
中文客服glm-5.1-air / glm-5-flash中文场景友好

后台字段建议

字段建议值
供应商ChatGLM / 智谱 AI
模型类型文本、推理、图像理解、工具调用
标签中文优化、低延迟、强推理、视觉、低成本
可用令牌分组默认开放通用模型,高级分组开放旗舰和视觉模型
计费类型通常按输入和输出 token 计费,视觉等能力可能有不同规则

推荐接入策略

  • 中文问答和客服优先测试 glm-5.1-airglm-5-flash
  • 复杂推理任务测试 GLM-5 系列
  • 视觉任务选择 GLM-V 系列
  • 高成本模型放入受控令牌分组

常见排错

现象优先检查
401是否使用 Xikapi Key,Authorization Header 是否正确
404Base URL 是否为 https://xikapi.com/v1
model not found模型是否已在 Xikapi 后台启用,ID 是否和后台一致
图片无法识别是否使用 GLM-V 类视觉模型,图片格式是否符合接口要求
延迟过高是否误用旗舰或推理模型,是否应切换 turbo / flash
工具调用异常当前模型是否支持工具调用,先用普通文本请求验证连通性