Skip to content

模型选择与能力对照

MiniMax 模型覆盖通用文本、长上下文、代码、Agent、角色对话和多模态任务。实际可用模型以 Xikapi 后台模型列表为准。

新手先确认

MiniMax 在 Xikapi 中通常按 OpenAI 兼容 Chat Completions 调用。长上下文和 Agent 场景容易消耗更多 token,建议先用短问题验证配置,再扩大输入长度。

要确认的内容正确做法常见误区
Base URLSDK 填 https://xikapi.com/v1填成完整 /chat/completions
API Key使用 Xikapi API Key使用 MiniMax 官方 Key 调 Xikapi 地址
模型名使用 Xikapi 后台启用的 MiniMax 模型 ID模型大小写和后台不一致
长上下文单独设置额度、超时和最大输出把超长文档直接发给默认模型
highspeed 版本用于低延迟场景以为 highspeed 一定比标准版更适合复杂任务

常见模型

模型适合场景说明
MiniMax-M2.8长上下文、代码、Agent新一代通用模型
MiniMax-M2.8-fast低延迟生产任务高速版本
MiniMax-M2.7通用文本、复杂任务性价比均衡
MiniMax-M2.7-fast快速响应上一代高速版本
M2-her角色对话、多轮聊天对话场景优化

按场景选择

场景推荐模型说明
普通聊天MiniMax-M2.8 / MiniMax-M2.8-fast按质量和延迟选择
长文档分析MiniMax-M2.8适合长上下文任务
代码助手MiniMax-M2.8适合代码分析和生成
Agent 工作流MiniMax-M2.8适合工具和多步骤任务
角色对话M2-her适合对话风格任务

后台字段建议

字段建议值
供应商MiniMax
模型类型文本、代码、长上下文、工具调用、语音、多模态
标签长上下文、高速、Agent、代码、角色对话、低延迟
可用令牌分组默认开放通用模型,高级分组开放长上下文和高成本模型
计费类型文本通常按 token,语音和图像等能力可能按独立规则

推荐接入策略

  • 通用生产任务优先测试 MiniMax-M2.8
  • 低延迟任务测试 highspeed 版本
  • 长上下文任务设置独立额度
  • 语音和多模态能力单独配置计费类型

常见排错

现象优先检查
401是否使用 Xikapi Key,Authorization Header 是否正确
404Base URL 是否为 https://xikapi.com/v1
model not found模型是否已在 Xikapi 后台启用,大小写是否一致
长文档失败或超时是否超过上下文限制,是否需要切分、摘要或提高超时
输出成本高是否把长上下文模型用于普通短任务
扩展参数无效reasoning_split 等参数是否被当前模型和兼容层支持