模型选择与能力对照
阿里云百炼模型以 Qwen 系列为主,常见能力包括通用文本、代码、视觉、多模态、长上下文、工具调用和联网搜索。实际可用模型以 Xikapi 后台模型列表为准。
新手先确认
阿里云百炼 / Qwen 模型在 Xikapi 中通常按 OpenAI 兼容 Chat Completions 调用。先跑通普通文本,再逐项测试联网搜索、思考模式、视觉和工具调用。
| 要确认的内容 | 正确做法 | 常见误区 |
|---|---|---|
| Base URL | SDK 填 https://xikapi.com/v1 | 填成完整 /chat/completions |
| API Key | 使用 Xikapi API Key | 把阿里云 Key 填到 Xikapi 地址里 |
| 模型名 | 使用 Xikapi 后台启用的 Qwen 模型 ID | 只看百炼官方模型名,后台未启用 |
| 联网搜索 | 选择支持搜索的模型并传对应扩展参数 | 普通模型直接加搜索参数 |
| 思考模式 | 逐模型验证 enable_thinking 等扩展参数 | 所有 Qwen 模型都默认支持 |
常见模型类型
| 类型 | 常见模型 | 适合场景 |
|---|---|---|
| 通用文本 | qwen-plus-latest、qwen3-max-2026-01-23、qwen-turbo-latest | 聊天、写作、总结、客服 |
| 推理模型 | 支持 thinking 的 Qwen 模型 | 复杂推理、数学、长链路分析 |
| 代码模型 | qwen-coder 系列 | 代码生成、重构、审查 |
| 视觉模型 | qwen-vl 系列 | 截图、票据、图表、图片问答 |
| 多模态模型 | 支持文本、图像等输入的 Qwen 模型 | 多模态助手、内容理解 |
按场景选择
| 场景 | 推荐模型类型 | 说明 |
|---|---|---|
| 普通聊天 | qwen-plus-latest / qwen-turbo-latest | 成本与质量均衡 |
| 高质量分析 | qwen3-max-2026-01-23 / thinking 模型 | 适合高价值任务 |
| 代码助手 | qwen-coder 系列 | 适合代码解释和生成 |
| 图片问答 | qwen-vl 系列 | 需要视觉输入能力 |
| 联网问答 | 支持搜索的 Qwen 模型 | 需要启用搜索参数 |
| 批量分类 | 低成本模型 | 注意吞吐和价格 |
后台字段建议
| 字段 | 建议值 |
|---|---|
| 供应商 | 阿里云百炼 |
| 模型类型 | 文本、推理、代码、图像理解、工具调用 |
| 标签 | 中文优化、低成本、强推理、视觉、联网搜索、代码 |
| 可用令牌分组 | 默认分组开放通用模型,高级分组开放高成本模型 |
| 计费类型 | 通常按输入和输出 token 计费,视觉、搜索等能力可能有附加成本 |
推荐接入策略
- 大多数生产文本任务优先测试
qwen-plus-latest - 高价值复杂任务测试
qwen3-max-2026-01-23或支持思考的模型 - 图片任务使用 Qwen-VL 类模型
- 联网搜索、思考模式、工具调用要单独做兼容验证
- 高成本模型不要默认开放给所有令牌
常见排错
| 现象 | 优先检查 |
|---|---|
401 | 是否使用 Xikapi Key,Authorization Header 是否正确 |
404 | SDK Base URL 是否为 https://xikapi.com/v1 |
model not found | Xikapi 后台是否启用该 Qwen 模型,模型名是否包含正确后缀 |
unsupported parameter | enable_search、enable_thinking 等扩展参数是否被该模型支持 |
| 视觉请求失败 | 是否选择 Qwen-VL 类模型,图片传入格式是否正确 |
| 输出风格不稳定 | 固定系统提示词,降低温度,并为关键任务增加校验 |