Skip to main content
三方模型调用教程

MiniMax

本文档介绍如何调用阿里云百炼部署的 MiniMax 模型推理服务。

MiniMax-M2.1 将于2026年7月9日下架。推荐转用:qwen3.7-plusqwen3.7-maxqwen3.6-flash
本文档描述的功能仅在华北2(北京)地域可用,如需使用模型,需从华北2(北京)地域获取与配置 API Key

快速开始

API 使用前提:已获取与配置 API Key并完成配置API Key到环境变量。如果通过SDK调用,需要安装SDK
  • OpenAI兼容
  • DashScope
  • Anthropic兼容
  • Python
  • Node.js
  • HTTP

示例代码

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # 以下为华北2(北京)地域的URL。请将 {WorkspaceId} 替换为您的百炼业务空间ID,各地域的URL不同。
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="MiniMax-M2.5",
    messages=[{"role": "user", "content": "你是谁"}],
    stream=True,
)

reasoning_content = ""  # 完整思考过程
answer_content = ""     # 完整回复
is_answering = False    # 是否进入回复阶段

print("\n" + "=" * 20 + "思考过程" + "=" * 20 + "\n")

for chunk in completion:
    if chunk.choices:
        delta = chunk.choices[0].delta
        # 只收集思考内容
        if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
            if not is_answering:
                print(delta.reasoning_content, end="", flush=True)
            reasoning_content += delta.reasoning_content
        # 收到content,开始进行回复
        if hasattr(delta, "content") and delta.content:
            if not is_answering:
                print("\n" + "=" * 20 + "完整回复" + "=" * 20 + "\n")
                is_answering = True
            print(delta.content, end="", flush=True)
            answer_content += delta.content

返回结果

====================思考过程====================

用户用中文问"你是谁",意思是"你是谁?"或"Who are you?"

我应该用中文回复,介绍自己是一个AI助手。
====================完整回复====================

你好!我是 MiniMax-M2.5,一个AI助手。我可以帮助你回答问题、提供信息、进行对话等。有什么我可以帮你的吗?

其它功能

模型多轮对话深度思考Function Calling结构化输出联网搜索前缀续写上下文缓存
MiniMax-M2.5支持支持支持不支持支持不支持支持
仅支持隐式缓存
MiniMax-M2.1支持支持支持不支持支持不支持不支持

参数默认值

模型

temperature

top_p

presence_penalty

MiniMax-M2.5

1.0

0.95

0.0

MiniMax-M2.1

1.0

0.95

0.0

模型列表与计费

MiniMax-M2.5 模型擅长编程、办公、文本摘要等任务,且输出速度快,推荐使用。 模型上下文长度与价格信息请参见百炼控制台 按照模型的输入与输出 Token 数量计费。

错误码

如果模型调用失败并返回报错信息,请参见错误码进行解决。
Token Plan
模型体验
  • 3D模型生成
  • 音乐生成
模型调优
模型压缩目录节点
用量统计与性能监控
资产中心
服务支持