kimi-k3 призначена для довгострокового програмування, агентів, складного міркування та знань, і може бути викликана через API Chat Completions, сумісний з OpenAI.
Цей документ в основному описує процес використання Kimi Chat Completion API, за допомогою якого ми можемо легко використовувати офіційні функції діалогу Kimi.
Процес заявки
Щоб використовувати Kimi Chat Completion API, спочатку перейдіть до консолі Ace Data Cloud для отримання вашого API Token, залиште його на випадок потреби.
Якщо ви ще не увійшли в систему або не зареєстровані, вас автоматично перенаправлять на сторінку входу, запрошуючи вас зареєструватися та увійти, після чого ви будете автоматично повернені на цю сторінку.
Один API Token дозволяє викликати всі послуги платформи, не потрібно окремо подавати заявку на кожну послугу. Перший запит на отримання токена надає безкоштовний ліміт, щоб ви могли безкоштовно спробувати; якщо ліміт вичерпано, ви можете поповнити загальний баланс в консолі.
📘 Повна документація: Kimi Chat Completion API →
Основне використання
Далі ви можете заповнити відповідні дані на інтерфейсі, як показано на малюнку:
authorization можна вибрати безпосередньо зі спадного списку; model використовується для вибору моделі Kimi, рекомендується використовувати kimi-k3; messages — це масив повідомлень діалогу, кожне повідомлення містить role та content, де role підтримує user, assistant, system та tool.
Ви також можете помітити, що праворуч є відповідний код виклику, який ви можете скопіювати та безпосередньо виконати, або просто натиснути кнопку «Спробувати» для тестування.

reasoning_effort: max (пропущені невикористані розширені поля):
id, ID, що генерує це завдання діалогу, використовується для унікальної ідентифікації цього завдання діалогу.model, вибрана модель Kimi з офіційного сайту.choices— інформація про відповіді Kimi на запитання.usage: статистична інформація про токени для цього запитання-відповіді.
choices міститься інформація про відповіді Kimi, в якій choices є конкретною інформацією про відповідь Kimi, що можна побачити на малюнку.

content в choices містить конкретний зміст відповіді Kimi; K3 також може повернути reasoning_content, що використовується для відображення процесу міркування.
Інтенсивність міркування K3
kimi-k3 завжди активує міркування. На верхньому рівні тіла запиту підтримується поле reasoning_effort, єдине підтримуване значення наразі — max; якщо це поле пропущено, також використовується max. standard, high або інші рядки можуть бути частково прийняті сумісними попередніми версіями, але не гарантують зміни поведінки міркування, не покладайтеся на це.
messages, включаючи reasoning_content та tool_calls.
Офіційні посилання
- Thinking Effort: пояснює, що Kimi K3 завжди активує міркування, наразі єдине підтримуване значення для
reasoning_effort—max. - Model Parameter Reference: порівнює параметри міркування K3 з K2, вікно контексту та відмінності у викликах інструментів.
- Create Chat Completion: офіційний запит Moonshot Chat Completions, відповіді та визначення полів OpenAPI.
Потокова відповідь
Цей інтерфейс також підтримує потокову відповідь, що дуже корисно для веб-інтеграції, дозволяючи веб-сторінці реалізувати ефект поетапного відображення. Якщо ви хочете отримати відповідь у потоковому режимі, ви можете змінити параметрstream у заголовку запиту на true.
Зміна, як показано на малюнку, але код виклику потребує відповідних змін, щоб підтримувати потокову відповідь.

stream на true, API буде повертати відповідні JSON дані по рядках, на рівні коду нам потрібно внести відповідні зміни, щоб отримати результати по рядках.
Приклад коду виклику на Python:
data, data містить choices, які є останнім відповіддю, що узгоджується з вищезгаданим змістом. choices є новим відповіддю, ви можете інтегрувати його у вашу систему. Водночас закінчення потокової відповіді визначається за змістом data, якщо зміст є [DONE], це означає, що потокова відповідь завершена. Повернуті результати data мають кілька полів, описаних нижче:
id, ID, що генерує цю розмову, використовується для унікальної ідентифікації цієї розмови.model, вибрано модель Kimi з офіційного сайту.choices, відповіді Kimi на запитання.
Багатократний діалог
Якщо ви хочете інтегрувати функцію багатократного діалогу, вам потрібно завантажити кілька запитів у полеmessages, приклади кількох запитів наведені на зображенні нижче:

choices, узгоджується з основним використанням, це містить конкретний зміст відповідей Kimi на кілька діалогів, таким чином, можна відповідати на відповідні запитання на основі кількох діалогів.
Обробка помилок
При виклику API, якщо виникає помилка, API поверне відповідний код помилки та інформацію. Наприклад:400 token_mismatched: Неправильний запит, можливо, через відсутні або недійсні параметри.400 api_not_implemented: Неправильний запит, можливо, через відсутні або недійсні параметри.401 invalid_token: Неавторизовано, недійсний або відсутній токен авторизації.429 too_many_requests: Занадто багато запитів, ви перевищили ліміт запитів.500 api_error: Внутрішня помилка сервера, щось пішло не так на сервері.
Приклад відповіді на помилку
Висновок
Завдяки цьому документу ви дізналися, як використовувати Kimi Chat Completion API для реалізації звичайного діалогу, потокових відповідей, багатократного діалогу, а також як контролювати інтенсивність міркувань K3 за допомогоюreasoning_effort.
