kimi-k3 предназначена для долгосрочного программирования, агентов, сложного вывода и интеллектуальной работы и может быть вызвана через совместимый с OpenAI API Chat Completions.
В этом документе в основном описывается процесс использования Kimi Chat Completion API, с помощью которого мы можем легко использовать официальные функции диалога Kimi.
Процесс заявки
Чтобы использовать Kimi Chat Completion API, сначала перейдите в консоль Ace Data Cloud, чтобы получить ваш API Token и сохранить его на всякий случай.
Если вы еще не вошли в систему или не зарегистрированы, вы будете автоматически перенаправлены на страницу входа, где вас пригласят зарегистрироваться и войти. После завершения вы будете автоматически возвращены на текущую страницу.
Один API Token позволяет вызывать все услуги платформы, не нужно отдельно запрашивать для каждой услуги. При первом запросе предоставляется бесплатный лимит, который можно использовать бесплатно; при недостатке лимита можно пополнить общий баланс в консоли.
📘 Полная документация: Kimi Chat Completion API →
Основное использование
Теперь вы можете заполнить соответствующие поля на интерфейсе, как показано на изображении:
authorization можно выбрать непосредственно из выпадающего списка; model используется для выбора модели Kimi, рекомендуется использовать kimi-k3; messages — это массив сообщений диалога, каждое сообщение содержит role и content, где role поддерживает user, assistant, system и tool.
Также вы можете заметить, что справа есть соответствующий сгенерированный код вызова, вы можете скопировать код и запустить его, или просто нажать кнопку «Попробовать» для тестирования.

reasoning_effort: max (пропущены неиспользуемые расширенные поля):
id— ID, сгенерированный для этой задачи диалога, используется для уникальной идентификации этой задачи.model— выбранная модель Kimi с официального сайта.choices— информация о ответах Kimi на заданные вопросы.usage— статистическая информация о токенах для данного вопроса и ответа.
choices содержится информация о ответах Kimi, внутри него choices — это конкретная информация о ответах Kimi, как показано на изображении.

content внутри choices содержит конкретное содержание ответа Kimi; K3 также может вернуть reasoning_content, чтобы отразить процесс вывода.
Интенсивность вывода K3
kimi-k3 всегда включает вывод. На верхнем уровне тела запроса поддерживается поле reasoning_effort, текущее единственное поддерживаемое значение — max; если это поле опущено, также используется max. Значения standard, high или другие строки могут быть частично совместимы с более свободным приемом, но не гарантируют изменения поведения вывода, не полагайтесь на это.
messages, включая reasoning_content и tool_calls.
Официальные ссылки
- Thinking Effort: объясняет, что Kimi K3 всегда включает вывод, текущее единственное поддерживаемое значение для
reasoning_effort—max. - Model Parameter Reference: сравнивает параметры вывода K3 и K2, различия в контекстном окне и вызовах инструментов.
- Create Chat Completion: официальные запросы, ответы и определения полей OpenAPI для Chat Completions от Moonshot.
Потоковый ответ
Этот интерфейс также поддерживает потоковые ответы, что очень полезно для веб-интеграции, позволяя веб-странице реализовать эффект отображения по буквам. Если вы хотите получить потоковый ответ, вы можете изменить параметрstream в заголовке запроса на true.
Изменение показано на изображении, однако код вызова должен быть соответствующим образом изменен, чтобы поддерживать потоковые ответы.

stream на true API будет возвращать соответствующие JSON данные построчно, на уровне кода нам нужно внести соответствующие изменения, чтобы получить построчные результаты.
Пример кода вызова на Python:
data, data внутри choices является последним ответом, что соответствует описанному выше содержимому. choices - это новый ответ, который вы можете интегрировать в вашу систему. В то же время, окончание потокового ответа определяется по содержимому data, если содержимое равно [DONE], это означает, что потоковый ответ завершен. Возвращаемый результат data содержит несколько полей, описание которых приведено ниже:
id- ID, генерирующий эту задачу диалога, используется для уникальной идентификации этой задачи диалога.model- выбранная модель Kimi.choices- информация о ответах Kimi на заданные вопросы.
Многоуровневый диалог
Если вы хотите интегрировать функцию многоуровневого диалога, вам нужно загрузить несколько вопросов в полеmessages, конкретные примеры нескольких вопросов приведены на изображении ниже:

choices, совпадает с содержимым базового использования, это включает конкретное содержание ответов Kimi на несколько диалогов, что позволяет отвечать на соответствующие вопросы на основе нескольких диалогов.
Обработка ошибок
При вызове API, если возникнет ошибка, API вернет соответствующий код ошибки и информацию. Например:400 token_mismatched: Неверный запрос, возможно, из-за отсутствующих или недействительных параметров.400 api_not_implemented: Неверный запрос, возможно, из-за отсутствующих или недействительных параметров.401 invalid_token: Неавторизован, недействительный или отсутствующий токен авторизации.429 too_many_requests: Слишком много запросов, вы превысили лимит частоты.500 api_error: Внутренняя ошибка сервера, что-то пошло не так на сервере.
Пример ответа об ошибке
Заключение
С помощью этого документа вы узнали, как использовать Kimi Chat Completion API для реализации обычного диалога, потоковых ответов, многоуровневого диалога, а также как контролировать интенсивность рассуждений K3 с помощьюreasoning_effort.
