模型选择与能力对照
MiniMax 模型覆盖通用文本、长上下文、代码、Agent、角色对话和多模态任务。实际可用模型以 Xikapi 后台模型列表为准。
新手先确认
MiniMax 在 Xikapi 中通常按 OpenAI 兼容 Chat Completions 调用。长上下文和 Agent 场景容易消耗更多 token,建议先用短问题验证配置,再扩大输入长度。
| 要确认的内容 | 正确做法 | 常见误区 |
|---|---|---|
| Base URL | SDK 填 https://xikapi.com/v1 | 填成完整 /chat/completions |
| API Key | 使用 Xikapi API Key | 使用 MiniMax 官方 Key 调 Xikapi 地址 |
| 模型名 | 使用 Xikapi 后台启用的 MiniMax 模型 ID | 模型大小写和后台不一致 |
| 长上下文 | 单独设置额度、超时和最大输出 | 把超长文档直接发给默认模型 |
| highspeed 版本 | 用于低延迟场景 | 以为 highspeed 一定比标准版更适合复杂任务 |
常见模型
| 模型 | 适合场景 | 说明 |
|---|---|---|
MiniMax-M2.8 | 长上下文、代码、Agent | 新一代通用模型 |
MiniMax-M2.8-fast | 低延迟生产任务 | 高速版本 |
MiniMax-M2.7 | 通用文本、复杂任务 | 性价比均衡 |
MiniMax-M2.7-fast | 快速响应 | 上一代高速版本 |
M2-her | 角色对话、多轮聊天 | 对话场景优化 |
按场景选择
| 场景 | 推荐模型 | 说明 |
|---|---|---|
| 普通聊天 | MiniMax-M2.8 / MiniMax-M2.8-fast | 按质量和延迟选择 |
| 长文档分析 | MiniMax-M2.8 | 适合长上下文任务 |
| 代码助手 | MiniMax-M2.8 | 适合代码分析和生成 |
| Agent 工作流 | MiniMax-M2.8 | 适合工具和多步骤任务 |
| 角色对话 | M2-her | 适合对话风格任务 |
后台字段建议
| 字段 | 建议值 |
|---|---|
| 供应商 | MiniMax |
| 模型类型 | 文本、代码、长上下文、工具调用、语音、多模态 |
| 标签 | 长上下文、高速、Agent、代码、角色对话、低延迟 |
| 可用令牌分组 | 默认开放通用模型,高级分组开放长上下文和高成本模型 |
| 计费类型 | 文本通常按 token,语音和图像等能力可能按独立规则 |
推荐接入策略
- 通用生产任务优先测试
MiniMax-M2.8 - 低延迟任务测试 highspeed 版本
- 长上下文任务设置独立额度
- 语音和多模态能力单独配置计费类型
常见排错
| 现象 | 优先检查 |
|---|---|
401 | 是否使用 Xikapi Key,Authorization Header 是否正确 |
404 | Base URL 是否为 https://xikapi.com/v1 |
model not found | 模型是否已在 Xikapi 后台启用,大小写是否一致 |
| 长文档失败或超时 | 是否超过上下文限制,是否需要切分、摘要或提高超时 |
| 输出成本高 | 是否把长上下文模型用于普通短任务 |
| 扩展参数无效 | reasoning_split 等参数是否被当前模型和兼容层支持 |