kimi-k3 призначена для довгострокового програмування, агентів, складного міркування та знань, і може бути викликана через API Chat Completions, сумісний з OpenAI.
Цей документ в основному описує процес використання Kimi Chat Completion API, за допомогою якого ми можемо легко використовувати офіційні функції діалогу Kimi.
Процес заявки
Щоб використовувати Kimi Chat Completion API, спочатку перейдіть до консолі Ace Data Cloud, щоб отримати ваш API Token, залиште його на випадок потреби.
Якщо ви ще не увійшли або не зареєструвалися, вас автоматично перенаправлять на сторінку входу, щоб запросити реєстрацію та вхід, після чого ви автоматично повернетеся на цю сторінку.
Один API Token дозволяє викликати всі послуги платформи, не потрібно окремо запитувати для кожної послуги. Перший запит надає безкоштовний ліміт, щоб ви могли безкоштовно спробувати; коли ліміт закінчиться, ви можете поповнити загальний баланс в консолі.
📘 Повна документація: Kimi Chat Completion API →
Основне використання
Далі ви можете заповнити відповідні дані на інтерфейсі, як показано на малюнку:
authorization можна вибрати безпосередньо зі списку; model використовується для вибору моделі Kimi, рекомендується використовувати kimi-k3; messages — це масив діалогових повідомлень, кожне повідомлення містить role та content, де role підтримує user, assistant, system та tool.
Ви також можете помітити, що праворуч є відповідний код виклику, який ви можете скопіювати та безпосередньо виконати, або просто натиснути кнопку «Спробувати» для тестування.

reasoning_effort: max (пропущені невикористані розширені поля):
id, ID, що генерує це завдання діалогу, використовується для унікальної ідентифікації цього завдання діалогу.model, вибрана модель Kimi з офіційного сайту.choices, відповіді Kimi на запитання.usage: статистична інформація про токени для цього запитання-відповіді.
choices міститься інформація про відповіді Kimi, в якій choices є конкретною інформацією про відповідь Kimi, що можна побачити на малюнку.

content в choices містить конкретний зміст відповіді Kimi; K3 також може повернути reasoning_content, щоб відобразити процес міркування.
Інтенсивність міркування K3
kimi-k3 завжди активує міркування. На верхньому рівні тіла запиту підтримується поле reasoning_effort, єдине підтримуване значення наразі — max; якщо це поле пропущено, також використовується max. standard, high або інші рядки можуть бути частково сумісно прийняті, але не гарантують зміни поведінки міркування, не покладайтеся на це.
messages, включаючи reasoning_content та tool_calls.
Офіційні посилання
- Thinking Effort: пояснює, що Kimi K3 завжди активує міркування, наразі єдине підтримуване значення для
reasoning_effort—max. - Model Parameter Reference: порівнює параметри міркування K3 та K2, вікно контексту та відмінності у викликах інструментів.
- Create Chat Completion: офіційний запит Moonshot Chat Completions, відповіді та визначення полів OpenAPI.
Потокова відповідь
Цей інтерфейс також підтримує потокову відповідь, що дуже корисно для веб-інтеграції, дозволяючи веб-сторінці реалізувати ефект поетапного відображення. Якщо ви хочете отримати відповідь у потоковому режимі, ви можете змінити параметрstream у заголовку запиту на true.
Зміна, як показано на малюнку, але код виклику потребує відповідних змін, щоб підтримувати потокову відповідь.

stream на true, API буде повертати відповідні JSON дані по рядках, на рівні коду нам потрібно внести відповідні зміни, щоб отримати результати по рядках.
Приклад коду виклику на Python:
data, data містить choices, які є останнім відповіддю, що узгоджується з вищезгаданим змістом. choices є новим відповіддю, ви можете підключити його до вашої системи. Водночас закінчення потокової відповіді визначається за змістом data, якщо зміст є [DONE], це означає, що потокова відповідь завершена. Повернуті результати data мають кілька полів, описаних нижче:
id, ID, що генерує цю розмову, використовується для унікальної ідентифікації цієї розмови.model, вибрано модель Kimi з офіційного сайту.choices, відповіді Kimi на запитання.
Багатократний діалог
Якщо ви хочете підключити функцію багатократного діалогу, вам потрібно завантажити кілька запитів у полеmessages, конкретні приклади кількох запитів наведені на зображенні нижче:

choices, узгоджується з основним використанням, це містить конкретний зміст відповідей Kimi на кілька діалогів, таким чином, можна відповідати на відповідні запитання на основі кількох діалогів.
Обробка помилок
При виклику API, якщо виникає помилка, API поверне відповідний код помилки та інформацію. Наприклад:400 token_mismatched: Неправильний запит, можливо, через відсутні або недійсні параметри.400 api_not_implemented: Неправильний запит, можливо, через відсутні або недійсні параметри.401 invalid_token: Неавторизовано, недійсний або відсутній токен авторизації.429 too_many_requests: Занадто багато запитів, ви перевищили ліміт запитів.500 api_error: Внутрішня помилка сервера, щось пішло не так на сервері.
Приклад відповіді на помилку
Висновок
Завдяки цьому документу ви дізналися, як використовувати Kimi Chat Completion API для реалізації звичайного діалогу, потокових відповідей, багатократного діалогу, а також як контролювати інтенсивність міркувань K3 за допомогоюreasoning_effort.
