Skip to main content
三方模型调用教程

Kimi-月之暗面

本文档介绍如何在阿里云百炼平台调用月之暗面(Moonshot AI)直供的模型推理服务。

三方直供模型 kimi/kimi-k2.5 将于2026年8月31日下架。推荐转用:kimi-k2.6 或其他模型。
本文档描述的功能仅在华北2(北京)地域可用,如需使用模型,需从华北2(北京)地域获取与配置 API Key

服务开通

  1. 前往百炼控制台,搜索 Kimi,找到 Kimi 模型卡片,单击立即开通;
  2. 在弹窗内确认开通及授权。
完成以上步骤即可调用月之暗面提供的 Kimi 模型服务。

快速开始

前提条件 kimi 系列模型均支持输入文本、图像或视频:
  1. kimi/kimi-k2.7-code-highspeed 与 kimi/kimi-k2.7-code 功能完全一致,速度提升5~6倍。
  2. kimi/kimi-k3、kimi/kimi-k2.7-code-highspeed、kimi/kimi-k2.7-code 为仅思考模型。
  3. kimi/kimi-k2.6、kimi/kimi-k2.5 可通过 enable_thinking 参数控制思考模式,默认开启思考模式:
    • 思考模式reasoning_effort: "max"):模型会输出详细的推理过程(reasoning_content
    • 非思考模式enable_thinking: false 或不设置):直接输出结果,不包含推理过程
除 kimi/kimi-k2.5外,其他模型均支持通过 preserve_thinking 参数在多轮对话中传递思考过程,详情请参见传递思考过程 以下示例演示如何调用思考模式的 kimi/kimi-k3 模型进行文本生成。
  • OpenAI兼容
reasoning_effort非 OpenAI 标准参数,OpenAI Python SDK 通过 extra_body传入,Node.js SDK 作为顶层参数传入。
  • Python
  • Node.js
  • HTTP
from openai import OpenAI
import os

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # 以下为华北2(北京)地域的URL。请将 {WorkspaceId} 替换为您的百炼业务空间ID,各地域的URL不同。
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="kimi/kimi-k3",
    messages=[{"role": "user", "content": "1+1等于多少?"}],
    # 通过 extra_body 设置 reasoning_effort 开启思考模式
    extra_body={"reasoning_effort": "max"}
)

msg = completion.choices[0].message

if getattr(msg, "reasoning_content", None):
    print("\n" + "=" * 20 + "思考过程" + "=" * 20 + "\n")
    print(msg.reasoning_content or "")
print("\n" + "=" * 20 + "完整回复" + "=" * 20 + "\n")
print(msg.content)

返回结果

====================思考过程====================

用户问了一个简单的数学问题:"1+1等于多少?"

这是一个非常基础的算术问题,答案是2。

我应该直接、清晰地回答这个问题。虽然用户用中文提问,但答案是一个通用的数学事实。

回答结构:
1. 直接给出答案:2
2. 可以简要说明这是基本的算术运算

不需要过度复杂化,保持简洁明了。

====================完整回复====================

1+1等于**2**。

这是最基本的算术运算,两个单位相加得到两个单位。

多模态调用示例

Kimi 系列模型不仅支持纯文本对话,还具备强大的多模态理解能力。本章节将介绍如何让模型理解图像和视频内容。
图像/视频文件仅支持通过公网URL传入,不支持 Base64 编码。

图像理解

图像理解功能让 Kimi 模型能够识别和分析图像内容。您可以传入单张或多张图像。图像文件的限制请参见图像限制
  • OpenAI兼容
  • Python
  • Node.js
  • HTTP
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # 以下为华北2(北京)地域的URL。请将 {WorkspaceId} 替换为您的百炼业务空间ID,各地域的URL不同。
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

# 单图传入示例(开启思考模式)
completion = client.chat.completions.create(
    model="kimi/kimi-k3",
    messages=[
        {
            "role": "user",
            "content": [
                {"type": "text", "text": "图中描绘的是什么景象?"},
                {
                    "type": "image_url",
                    "image_url": {
                        "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"
                    }
                }
            ]
        }
    ],
    extra_body={"reasoning_effort":"max"}  # 开启思考模式
)

# 输出思考过程
if hasattr(completion.choices[0].message, 'reasoning_content') and completion.choices[0].message.reasoning_content:
    print("\n" + "=" * 20 + "思考过程" + "=" * 20 + "\n")
    print(completion.choices[0].message.reasoning_content)

# 输出回复内容
print("\n" + "=" * 20 + "完整回复" + "=" * 20 + "\n")
print(completion.choices[0].message.content)

# 多图传入示例(开启思考模式,取消注释使用)
# completion = client.chat.completions.create(
#     model="kimi/kimi-k3",
#     messages=[
#         {
#             "role": "user",
#             "content": [
#                 {"type": "text", "text": "这些图描绘了什么内容?"},
#                 {
#                     "type": "image_url",
#                     "image_url": {"url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"}
#                 },
#                 {
#                     "type": "image_url",
#                     "image_url": {"url": "https://dashscope.oss-cn-beijing.aliyuncs.com/images/tiger.png"}
#                 }
#             ]
#         }
#     ],
#     extra_body={"reasoning_effort":"max"}
# )
#
# # 输出思考过程和回复
# if hasattr(completion.choices[0].message, 'reasoning_content') and completion.choices[0].message.reasoning_content:
#     print("\n思考过程:\n" + completion.choices[0].message.reasoning_content)
# print("\n完整回复:\n" + completion.choices[0].message.content)

视频理解

视频文件的限制请参见视频限制
  • OpenAI兼容
  • Python
  • Node.js
  • HTTP
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    # 以下为华北2(北京)地域的URL。请将 {WorkspaceId} 替换为您的百炼业务空间ID,各地域的URL不同。
    base_url="https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="kimi/kimi-k3",
    messages=[
        {
            "role": "user",
            "content": [
                # 直接传入视频文件时,请将type的值设置为video_url
                {
                    "type": "video_url",
                    "video_url": {
                        "url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241115/cqqkru/1.mp4"
                    }
                },
                {
                    "type": "text",
                    "text": "这段视频的内容是什么?"
                }
            ]
        }
    ]
)

print(completion.choices[0].message.content)

文件限制

  • 图像文件
  • 视频文件
  • 图像分辨率:建议图像分辨率不超过4k (4096*2160)
  • 支持的图像格式:PNG、JPEG、WEBP、GIF
  • 图像大小与图像数量:无限制,但需确保请求的文本和图像的大小不超过 100M。

其它功能

模型

多轮对话

Function Calling

前缀续写

联网搜索

上下文缓存

结构化输出

kimi/kimi-k3

支持

支持

支持

不支持

支持

支持

kimi/kimi-k2.7-code-highspeed

kimi/kimi-k2.7-code

kimi/kimi-k2.6

kimi/kimi-k2.5

以上模型支持上下文缓存(隐式缓存,自动开启):
  • kimi/kimi-k3命中缓存的输入Token按输入价格的10%计费
  • kimi/kimi-k2.7-code-highspeed、kimi/kimi-k2.7-code 命中缓存的输入Token按输入价格的20.0%计费,
  • kimi/kimi-k2.6命中缓存的输入Token按输入价格的16.9%计费
  • kimi/kimi-k2.5命中缓存的输入Token按输入价格的17.5%计费。

参数默认值

模型

tool_choice

preserve_thinking

reasoning_effort

temperature

top_p

repetition_penalty

presence_penalty

stream_options

kimi/kimi-k3

auto

默认关闭

max

1

0.95

0.0

-

仅支持设置为true

kimi/kimi-k2.7-code-highspeed

auto

默认开启

-

1.0

0.95

0.0

0.0

仅支持设置为true

kimi/kimi-k2.7-code

auto

默认开启

-

1.0

0.95

0.0

0.0

仅支持设置为true

kimi/kimi-k2.6

思考模式/非思考模式:auto

默认关闭

-

思考模式:1.0
非思考模式:0.6

思考模式/非思考模式:0.95

思考模式/非思考模式:0.0

思考模式/非思考模式:0.0

仅支持设置为true

kimi/kimi-k2.5

-

-

  • stream_options仅支持设置为truetemperaturetop_prepetition_penaltypresence_penalty不支持设置为其他值;
  • kimi/kimi-k3 支持 reasoning_effort 参数,唯一支持值 max
  • 在思考模式下,使用 Kimi 模型进行工具调用时:必须在每轮 assistant 消息中保留 reasoning_content 字段;对于tool_choice参数,kimi-k3 支持 auto / none / required 三档;其他模型不支持 required,传入会报错。kimi-k3 支持动态加载工具,详细用法请参见动态加载工具
  • ”-”表示没有默认值,也不支持设置。

模型列表与计费

模型上下文长度与价格信息请参见百炼控制台 按照模型的输入与输出 Token 计费。
思考模式下,思维链按照输出 Token 计费。

错误码

如果执行报错,请参见错误码进行解决。
Token Plan
模型体验
  • 3D模型生成
  • 音乐生成
模型调优
模型压缩目录节点
用量统计与性能监控
资产中心
服务支持