PL ▾
Pobierz klucz API

Szybki start dla użytkowników Kimi

Wstaw nowy base URL i klucz API, aby przekierować istniejące wywołania OpenAI SDK do LLM bez cenzury. Ten przewodnik pokazuje dokładnie trzy linie potrzebne do rozpoczęcia czatu, strumieniowania i używania narzędzi z naszym kompatybilnym endpointem.

Wymagania wstępne: Klucz API

Przed wysłaniem zapytań potrzebujesz klucza API. Zarejestruj się na stronie Pobierz klucz API używając przycisku Kontynuuj z Google lub adresu e-mail i hasła. Twój klucz pojawi się natychmiast. Nowe konta otrzymują $0,50 kredytu próbnego ważnego przez 7 dni; nie jest wymagana karta kredytowa. W przypadku płatnego użytku doładuj USDT (TRC20) lub USDC (Base). Kwoty doładowania wynoszą od $10 do $500. Otrzymujesz bonus +5% przy doładowaniach od $50 i bonus +10% przy kwotach od $100. Kredyt nigdy nie wygasa i jest naliczany tylko za rzeczywiste użycie tokenów. Błędy i odmowy są darmowe. Możesz posiadać jeden aktywny klucz na konto; wygenerowanie nowego klucza zastępuje poprzedni. Użyj tego klucza w nagłówku Authorization dla wszystkich zapytań.

Podstawowe uzupełnianie czatu

Endpoint kimi api obsługuje standardowe żądania chat-completion OpenAI. Ustaw base URL klienta na https://api.kimiapi.cc/v1 i podaj swój klucz. Oferujemy pojedynczy, dedykowany model bez cenzury z identyfikatorem uncensored. Jest to model o otwartych wagach, działający na naszych serwerach, który nie odrzuca legalnych treści dla dorosłych, fikcyjnych lub kontrowersyjnych tematów. Nie jest to GPT, Claude, Gemini ani żaden inny model dostawcy. Możesz wysyłać prompty i otrzymywać odpowiedzi tekstowe. Model obsługuje okno kontekstu o rozmiarze 100 000 tokenów (prompt + completion). Maksymalna liczba tokenów na zapytanie to 32 000, lub 2 048, jeśli nie ustawisz max_tokens. Nie generuje embeddingów, obrazów ani audio.

Odpowiedzi strumieniowe

Użyj zdarzeń wysłanych przez serwer (SSE) do strumieniowania. API przesyła tokeny w miarę ich generowania. Informacje o zużyciu tokenów są zawarte w ostatnim fragmencie strumienia. Pozwala to monitorować koszty w czasie rzeczywistym bez oczekiwania na pełną odpowiedź. Strumieniowanie jest obsługiwane przez wszystkie standardowe SDK kompatybilne z OpenAI. Ustaw stream=true w swoim zapytaniu. Klient otrzyma serię obiektów delta zawierających tekst. Możesz połączyć te fragmenty, aby odtworzyć pełną odpowiedź. Jest to idealne dla interfejsów czatu, gdzie użytkownicy oczekują natychmiastowej reakcji. kimi api zapewnia przewidywalne opóźnienie, unikając narzutu pośrednictwa.

Wywoływanie funkcji (Narzędzia)

API obsługuje wywoływanie funkcji, znane również jako narzędzia. Możesz zdefiniować narzędzia w swoim żądaniu, a model zwróci strukturyzowane argumenty, gdy będzie to odpowiednie. Użyj parametru tools, aby przekazać listę definicji narzędzi. Możesz również użyć tool_choice, aby wymusić lub automatycznie wybrać narzędzia. Model zwraca odpowiedź z wywołaniami narzędzi, które możesz przekazać z powrotem do API, aby kontynuować rozmowę. Umożliwia to budowanie agentów lub zautomatyzowanych przepływów pracy. Definicje narzędzi są zgodne ze standardowym formatem OpenAI. Model bez cenzury precyzyjnie obsługuje definicje narzędzi, nie odmawiając ich użycia w poprawnych przypadkach użycia. Tryb JSON jest również dostępny dla ściślejszego formatowania outputu.

Tryb JSON

Dla aplikacji wymagających ścisłego outputu użyj trybu JSON. Ustaw response_format na {"type": "json_object"}. Model spróbuje zwrócić poprawny obiekt JSON. Jest to przydatne do parsowania danych, generowania plików konfiguracyjnych lub przekazywania danych strukturalnych do innych systemów. Tryb JSON działa wraz z wywoływaniem funkcji. Możesz również ustawić parametry takie jak temperature, top_p, stop, seed, presence_penalty oraz frequency_penalty, aby kontrolować kreatywność i determinizm. Parametry te są standardowe dla klientów kompatybilnych z OpenAI. Dostosuj je, aby zbalansować spójność i kreatywność w zależności od przypadku użycia.

Limity, błędy i kontekst

Każdy klucz API jest ograniczony do 300 zapytań na minutę i 8 równoległych zapytań. Ciało żądania nie może przekraczać 8 MB. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli nie masz kredytu, otrzymasz błąd 402. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Błędy i odrzucenia są darmowe, więc nie są rozliczane za nieudane zapytania. Okno kontekstu wynosi łącznie 100 000 tokenów. Obowiązuje twardy limit treści: żądania zawierające treści seksualne z udziałem małoletnich są zawsze odrzucane. API jest tylko tekstowe. Nie są dostępne embeddingi, obrazy ani fine-tuning. Dla modeli innych dostawców sprawdź ich dokumentację w celu uzyskania aktualnych cen i limitów. Ta usługa jest niezależną alternatywą, niepowiązaną z nimi.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Strumieniowanie

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
Base URLhttps://api.kimiapi.cc/v1
ID modeluuncensored
UwierzytelnianieAuthorization: Bearer YOUR_KEY
EndpointyPOST /v1/chat/completions · GET /v1/models
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Jaka jest wielkość okna kontekstu i limit outputu?

Okno kontekstu wynosi 100 000 tokenów dla promptu i uzupełnienia łącznie. Maksymalny output na zapytanie to 32 000 tokenów. Jeśli nie ustawisz <code>max_tokens</code>, limit wynosi 2048 tokenów.

Jak doładować kredyt?

Doładuj używając tylko kryptowalut: USDT (TRC20) lub USDC (Base). Akceptowane kwoty to pełne dolary od $10 do $500. Otrzymujesz bonus +5% przy doładowaniach od $50 i bonus +10% przy kwotach od $100. Kredyt nigdy nie wygasa.

Czy to oficjalny API Kimi?

Nie. To niezależna usługa zapewniająca endpoint kompatybilny z OpenAI. Oferujemy jeden model bez cenzury. Nie jesteśmy powiązani z Moonshot AI ani żadnym innym dostawcą. Sprawdź dokumentację odpowiednich dostawców w celu uzyskania informacji o ich oficjalnych API.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cała konfiguracja.

Pobierz klucz API