Szybki start dla użytkowników Kimi
Wstaw nowy base URL i klucz API, aby przekierować istniejące wywołania OpenAI SDK do LLM bez cenzury. Ten przewodnik pokazuje dokładnie trzy linie potrzebne do rozpoczęcia czatu, strumieniowania i używania narzędzi z naszym kompatybilnym endpointem.
Wymagania wstępne: Klucz API
Przed wysłaniem zapytań potrzebujesz klucza API. Zarejestruj się na stronie Pobierz klucz API używając przycisku Kontynuuj z Google lub adresu e-mail i hasła. Twój klucz pojawi się natychmiast. Nowe konta otrzymują $0,50 kredytu próbnego ważnego przez 7 dni; nie jest wymagana karta kredytowa. W przypadku płatnego użytku doładuj USDT (TRC20) lub USDC (Base). Kwoty doładowania wynoszą od $10 do $500. Otrzymujesz bonus +5% przy doładowaniach od $50 i bonus +10% przy kwotach od $100. Kredyt nigdy nie wygasa i jest naliczany tylko za rzeczywiste użycie tokenów. Błędy i odmowy są darmowe. Możesz posiadać jeden aktywny klucz na konto; wygenerowanie nowego klucza zastępuje poprzedni. Użyj tego klucza w nagłówkuAuthorization dla wszystkich zapytań.
Podstawowe uzupełnianie czatu
Endpointkimi api obsługuje standardowe żądania chat-completion OpenAI. Ustaw base URL klienta na https://api.kimiapi.cc/v1 i podaj swój klucz. Oferujemy pojedynczy, dedykowany model bez cenzury z identyfikatorem uncensored. Jest to model o otwartych wagach, działający na naszych serwerach, który nie odrzuca legalnych treści dla dorosłych, fikcyjnych lub kontrowersyjnych tematów. Nie jest to GPT, Claude, Gemini ani żaden inny model dostawcy. Możesz wysyłać prompty i otrzymywać odpowiedzi tekstowe. Model obsługuje okno kontekstu o rozmiarze 100 000 tokenów (prompt + completion). Maksymalna liczba tokenów na zapytanie to 32 000, lub 2 048, jeśli nie ustawisz max_tokens. Nie generuje embeddingów, obrazów ani audio.
Odpowiedzi strumieniowe
Użyj zdarzeń wysłanych przez serwer (SSE) do strumieniowania. API przesyła tokeny w miarę ich generowania. Informacje o zużyciu tokenów są zawarte w ostatnim fragmencie strumienia. Pozwala to monitorować koszty w czasie rzeczywistym bez oczekiwania na pełną odpowiedź. Strumieniowanie jest obsługiwane przez wszystkie standardowe SDK kompatybilne z OpenAI. Ustawstream=true w swoim zapytaniu. Klient otrzyma serię obiektów delta zawierających tekst. Możesz połączyć te fragmenty, aby odtworzyć pełną odpowiedź. Jest to idealne dla interfejsów czatu, gdzie użytkownicy oczekują natychmiastowej reakcji. kimi api zapewnia przewidywalne opóźnienie, unikając narzutu pośrednictwa.
Wywoływanie funkcji (Narzędzia)
API obsługuje wywoływanie funkcji, znane również jako narzędzia. Możesz zdefiniować narzędzia w swoim żądaniu, a model zwróci strukturyzowane argumenty, gdy będzie to odpowiednie. Użyj parametrutools, aby przekazać listę definicji narzędzi. Możesz również użyć tool_choice, aby wymusić lub automatycznie wybrać narzędzia. Model zwraca odpowiedź z wywołaniami narzędzi, które możesz przekazać z powrotem do API, aby kontynuować rozmowę. Umożliwia to budowanie agentów lub zautomatyzowanych przepływów pracy. Definicje narzędzi są zgodne ze standardowym formatem OpenAI. Model bez cenzury precyzyjnie obsługuje definicje narzędzi, nie odmawiając ich użycia w poprawnych przypadkach użycia. Tryb JSON jest również dostępny dla ściślejszego formatowania outputu.
Tryb JSON
Dla aplikacji wymagających ścisłego outputu użyj trybu JSON. Ustawresponse_format na {"type": "json_object"}. Model spróbuje zwrócić poprawny obiekt JSON. Jest to przydatne do parsowania danych, generowania plików konfiguracyjnych lub przekazywania danych strukturalnych do innych systemów. Tryb JSON działa wraz z wywoływaniem funkcji. Możesz również ustawić parametry takie jak temperature, top_p, stop, seed, presence_penalty oraz frequency_penalty, aby kontrolować kreatywność i determinizm. Parametry te są standardowe dla klientów kompatybilnych z OpenAI. Dostosuj je, aby zbalansować spójność i kreatywność w zależności od przypadku użycia.
Limity, błędy i kontekst
Każdy klucz API jest ograniczony do 300 zapytań na minutę i 8 równoległych zapytań. Ciało żądania nie może przekraczać 8 MB. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli nie masz kredytu, otrzymasz błąd 402. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Błędy i odrzucenia są darmowe, więc nie są rozliczane za nieudane zapytania. Okno kontekstu wynosi łącznie 100 000 tokenów. Obowiązuje twardy limit treści: żądania zawierające treści seksualne z udziałem małoletnich są zawsze odrzucane. API jest tylko tekstowe. Nie są dostępne embeddingi, obrazy ani fine-tuning. Dla modeli innych dostawców sprawdź ich dokumentację w celu uzyskania aktualnych cen i limitów. Ta usługa jest niezależną alternatywą, niepowiązaną z nimi.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Strumieniowanie
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Base URL | https://api.kimiapi.cc/v1 |
| ID modelu | uncensored |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Rozmiar zapytania | do 8 MB |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jaka jest wielkość okna kontekstu i limit outputu?
Okno kontekstu wynosi 100 000 tokenów dla promptu i uzupełnienia łącznie. Maksymalny output na zapytanie to 32 000 tokenów. Jeśli nie ustawisz <code>max_tokens</code>, limit wynosi 2048 tokenów.
Jak doładować kredyt?
Doładuj używając tylko kryptowalut: USDT (TRC20) lub USDC (Base). Akceptowane kwoty to pełne dolary od $10 do $500. Otrzymujesz bonus +5% przy doładowaniach od $50 i bonus +10% przy kwotach od $100. Kredyt nigdy nie wygasa.
Czy to oficjalny API Kimi?
Nie. To niezależna usługa zapewniająca endpoint kompatybilny z OpenAI. Oferujemy jeden model bez cenzury. Nie jesteśmy powiązani z Moonshot AI ani żadnym innym dostawcą. Sprawdź dokumentację odpowiednich dostawców w celu uzyskania informacji o ich oficjalnych API.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.