RU ▾
Получить API-ключ

Быстрый старт для пользователей Kimi

Укажите новый базовый URL и API-ключ, чтобы направить существующие вызовы OpenAI SDK на LLM-модель без цензуры. В этом руководстве показаны три строки кода для начала работы: чат, потоковая передача и использование инструментов через наш совместимый эндпоинт.

Требования: API-ключ

Перед отправкой запросов вам нужен API-ключ. Зарегистрируйтесь на странице Получить API-ключ, используя Вход через Google или электронную почту и пароль. Ваш ключ появится сразу. На новые аккаунты начисляется бесплатный пробный баланс в размере $0.50, действительный в течение 7 дней; карта не требуется. Для платного использования пополните баланс с помощью USDT (TRC20) или USDC (Base). Пополнение от $10 до $500. При пополнении от $50 вы получаете бонус +5%, а от $100 — бонус +10%. Баланс не сгорает, списание происходит только за реальные токены. Ошибки и отказы бесплатны. На одном аккаунте может быть активен только один ключ; генерация нового заменяет старый. Используйте этот ключ в заголовке Authorization для всех запросов.

Базовое завершение чата

Эндпоинт kimi api принимает стандартные запросы OpenAI chat-completion. Установите базовый URL клиента на https://api.kimiapi.cc/v1 и укажите ключ. Мы предоставляем одну выделенную модель без цензуры с идентификатором uncensored. Это модель с открытыми весами, работающая на наших серверах; она не отказывается от законных тем для взрослых, художественных или спорных тем. Это не GPT, Claude, Gemini и не модель другого вендора. Вы можете отправлять промпты и получать текстовые ответы. Модель поддерживает контекстное окно на 100 000 токенов (промпт + ответ). Максимальный вывод на запрос — 32 000 токенов, или 2 048, если не установлен max_tokens. Эмбеддинги, изображения и аудио не генерируются.

Потоковые ответы

Используйте Server-Sent Events (SSE) для потоковой передачи. API отправляет токены по мере их генерации. Информация об использовании токенов включается в последний чанк потока. Это позволяет отслеживать расходы в реальном времени без ожидания полного ответа. Потоковая передача поддерживается всеми стандартными SDK, совместимыми с OpenAI. Установите stream=true в запросе. Клиент получит серию объектов delta с текстом. Вы можете объединить эти дельты, чтобы восстановить полный ответ. Это идеально подходит для чат-интерфейсов, где пользователи ожидают мгновенной обратной связи. kimi api обеспечивает предсказуемую задержку, избегая накладных расходов прокси.

Вызов функций (инструменты)

API поддерживает вызов функций (tools). Вы можете определить инструменты в запросе, и модель вернёт структурированные аргументы, когда это уместно. Используйте параметр tools для передачи списка определений инструментов. Также можно использовать tool_choice для принудительного или автоматического выбора инструментов. Модель возвращает ответ с вызовами инструментов, которые можно передать обратно в API для продолжения разговора. Это позволяет создавать агентов или автоматизированные рабочие процессы. Определения инструментов соответствуют стандартному формату OpenAI. Модель без цензуры точно обрабатывает определения инструментов, не отказываясь использовать их для корректных сценариев. Также доступен JSON-режим для более строгого форматирования вывода.

JSON-режим

Для приложений, требующих строгого вывода, используйте JSON-режим. Установите response_format в значение {"type": "json_object"}. Модель попытается вернуть валидный объект JSON. Это полезно для парсинга данных, генерации конфигурационных файлов или подачи структурированных данных в другие системы. JSON-режим работает вместе с вызовом функций. Вы также можете установить параметры temperature, top_p, stop, seed, presence_penalty и frequency_penalty для управления креативностью и детерминизмом. Эти параметры стандартны для клиентов, совместимых с OpenAI. Настройте их, чтобы сбалансировать согласованность и креативность в зависимости от вашей задачи.

Лимиты, ошибки и контекст

Каждый API-ключ ограничен 300 запросами в минуту и 8 параллельными запросами. Тело запроса не должно превышать 8 МБ. Если ключ недействителен, вы получите ошибку 401. Если у вас нет баланса, вы получите ошибку 402. При превышении лимита запросов вы получите ошибку 429. Ошибки и отказы бесплатны, поэтому за неудачные запросы вы не платите. Контекстное окно составляет 100 000 токенов в сумме. Применяется строгий лимит контента: запросы с участием несовершеннолетних в сексуальном контексте всегда отклоняются. API работает только с текстом. Эмбеддинги, изображения и дообучение недоступны. Для моделей других вендоров проверьте их документацию на предмет актуальных цен и лимитов. Этот сервис — независимая альтернатива, не аффилированная с ними.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Потоковая передача

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Технические характеристики

Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.

ПараметрЗначение
Формат APIсовместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ
Base URLhttps://api.kimiapi.cc/v1
ID моделиuncensored
АвторизацияAuthorization: Bearer YOUR_KEY
ЭндпоинтыPOST /v1/chat/completions · GET /v1/models
JSON-режимresponse_format: {"type": "json_object"}
Параметрыtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Контекстное окно100 000 токенов (вход и ответ вместе)
Вызов функцийда — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool
Потоковая передачада — server-sent events, последний фрагмент содержит расход токенов
Максимум ответадо остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет)
Размер запросадо 8 МБ
Лимит запросов300 запросов в минуту на ключ
Заголовки ответаX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Параллельные запросыдо 8 одновременно на ключ
Пробный баланс$0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения
Срок действияоплаченный баланс не сгорает, без подписки
Оплатапредоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны
ПополнениеUSDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500
Бонус+5% от $50, +10% от $100
Цена$0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных
ВходGoogle или e-mail и пароль
Ключиодин активный ключ на аккаунт; новый заменяет старый
Контентконтент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён

Коды ошибок

Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.

КодТипЧто значит
400bad_requestневерный JSON, пустые сообщения, неверный параметр или превышено окно контекста
401missing_key · invalid_key · key_revokedнет ключа, ключ неверный или заменён новым
402no_creditбаланс пуст — пополните, работа продолжится сразу
403content_blockedсексуальный контент с несовершеннолетними — отказ, без оплаты
404not_foundнеизвестный эндпоинт
413request_too_largeтело запроса больше 8 МБ
429rate_limited · concurrencyбольше 300/мин или 8 параллельно — подождите и повторите
503upstream_busyмодель занята — повторите через несколько секунд

Вопросы и ответы

Что такое контекстное окно и лимит вывода?

Контекстное окно составляет 100 000 токенов для промпта и завершения вместе. Максимальный вывод на запрос — 32 000 токенов. Если вы не установите <code>max_tokens</code>, лимит составляет 2 048 токенов.

Как пополнить мой баланс?

Пополняйте только криптовалютой: USDT (TRC20) или USDC (Base). Принимаются целые суммы от $10 до $500. За пополнение от $50 начисляется бонус +5%, от $100 — +10%. Баланс не сгорает.

Это официальный API Kimi?

Нет. Это независимый сервис, предоставляющий эндпоинт, совместимый с OpenAI. Мы обслуживаем одну модель без цензуры. Мы не связаны с Moonshot AI или другими поставщиками. Официальные API других венторов смотрите в их документации.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ