NL ▾
API-sleutel aanvragen

Snelstart voor Kimi-gebruikers

Voeg een nieuwe base URL en API-sleutel toe om je bestaande OpenAI SDK-aanroepen te routeren naar een ongecensureerde LLM. Deze gids toont de exacte drie regels die nodig zijn om te beginnen met chatten, streaming en het gebruiken van tools met ons compatibele endpoint.

Vereisten: API-sleutel

Voordat je verzoeken stuurt, heb je een API-sleutel nodig. Meld je aan op de pagina API-sleutel ophalen met Doorgaan met Google of een e-mailadres en wachtwoord. Je sleutel verschijnt direct. Nieuwe accounts ontvangen $0,50 aan gratis proeftegoed dat 7 dagen geldig is; er is geen creditcard nodig. Voor betaald gebruik laad je op met USDT (TRC20) of USDC (Base). Stortingen variëren van $10 tot $500. Je ontvangt een bonus van +5% voor stortingen van $50 of meer, en een bonus van +10% voor $100 of meer. Het tegoed vervalt nooit en wordt alleen in rekening gebracht voor daadwerkelijk token-gebruik. Fouten en weigeringen zijn gratis. Je kunt één actieve sleutel per account hebben; het genereren van een nieuwe sleutel vervangt de oude. Gebruik deze sleutel in de Authorization-header voor alle verzoeken.

Basis chatcompletie

Het kimi api-endpoint accepteert standaard OpenAI chat-completie-verzoeken. Stel de basis-URL van je client in op https://api.kimiapi.cc/v1 en lever je sleutel. Wij bieden één toegewijd ongecensureerd model aan, geïdentificeerd door de ID uncensored. Dit model is een open-weight model, draait op onze servers en weigert geen wettelijke volwassen, fictieve of controversiële onderwerpen. Het is geen GPT, Claude, Gemini of een model van een andere leverancier. Je kunt prompts versturen en tekstantwoorden ontvangen. Het model ondersteunt een contextvenster van 100.000 tokens (prompt + antwoord). De maximale uitvoer per verzoek is 32.000 tokens, of 2.048 als je max_tokens niet instelt. Er worden geen embeddings, afbeeldingen of audio gegenereerd.

Streaming-antwoorden

Gebruik Server-Sent Events (SSE) voor streaming. De API streamt tokens zodra ze gegenereerd zijn. Token-gebruiksinformatie is opgenomen in het laatste chunk van de stream. Dit stelt je in staat kosten in realtime te monitoren zonder te wachten op de volledige respons. Streaming wordt ondersteund door alle standaard OpenAI-compatible SDK's. Stel stream=true in je verzoek in. De client ontvangt een reeks delta-objecten met de tekst. Je kunt deze deltas concatenen om de volledige respons te reconstrueren. Dit is ideaal voor chatinterfaces waar gebruikers directe feedback verwachten. De kimi api zorgt voor voorspelbare latentie door proxy-overhead te vermijden.

Function calling (tools)

De API ondersteunt function calling, ook wel tools genoemd. Je kunt tools definiëren in je verzoek en het model geeft gestructureerde argumenten terug wanneer dit gepast is. Gebruik de parameter tools om een lijst met tool-definities door te geven. Je kunt ook tool_choice gebruiken om tools te forceren of automatisch te selecteren. Het model retourneert een antwoord met tool calls, die je terug kunt sturen naar de API om het gesprek voort te zetten. Dit stelt je in staat agents of geautomatiseerde workflows te bouwen. De tool-definities volgen de standaard OpenAI-indeling. Het ongecensureerde model verwerkt tool-definities nauwkeurig zonder ze te weigeren voor geldige toepassingen. JSON-modus is ook beschikbaar voor strengere uitvoerindeling.

JSON-modus

Voor toepassingen die een strenge uitvoer vereisen, gebruik je JSON-modus. Stel response_format in op {"type": "json_object"}. Het model zal proberen een geldig JSON-object te retourneren. Dit is nuttig voor het parseren van data, het genereren van configuratiebestanden of het voeden van gestructureerde data in andere systemen. JSON-modus werkt samen met function calling. Je kunt ook parameters instellen zoals temperature, top_p, stop, seed, presence_penalty en frequency_penalty om creativiteit en determinisme te regelen. Deze parameters zijn standaard voor OpenAI-compatibele clients. Pas ze aan om consistentie en creativiteit af te stemmen op jouw gebruikssituatie.

Limieten, Fouten & Context

Elke API-sleutel is beperkt tot 300 verzoeken per minuut en 8 gelijktijdige verzoeken. De requestbody mag niet groter zijn dan 8 MB. Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen tegoed hebt, ontvang je een 402-fout. Als je de rate limit overschrijdt, ontvang je een 429-fout. Fouten en weigeringen zijn gratis, dus je wordt niet in rekening gebracht voor mislukte verzoeken. Het contextvenster is 100.000 tokens in totaal. Er geldt een harde inhoudsgrens: verzoeken die seksuele inhoud met minderjarigen bevatten, worden altijd geweigerd. De API is alleen voor tekst. Er zijn geen embeddings, afbeeldingen of fine-tuning beschikbaar. Voor modellen van andere leveranciers raadpleeg je hun documentatie voor huidige prijzen en limieten. Deze dienst is een onafhankelijk alternatief, niet gelieerd aan hen.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.kimiapi.cc/v1
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat is het contextvenster en de outputlimiet?

Het contextvenster is 100.000 tokens voor de prompt en het antwoord samen. De maximale uitvoer per verzoek is 32.000 tokens. Als je <code>max_tokens</code> niet instelt, is de limiet 2.048 tokens.

Hoe laad ik mijn tegoed op?

Laad tegoed op met alleen crypto: USDT (TRC20) of USDC (Base). Geaccepteerde bedragen zijn hele dollars van $10 tot $500. Je ontvangt een bonus van +5% voor stortingen van $50 of meer, en een bonus van +10% voor $100 of meer. Credit vervalt nooit.

Is dit de officiële Kimi API?

Nee. Dit is een onafhankelijke service die een OpenAI-compatible endpoint biedt. We serveren één ongecensureerd model. We zijn niet gelieerd aan Moonshot AI of een andere leverancier. Controleer de documentatie van de respectievelijke leverancier voor hun officiële API's.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, verander de basis-URL. Dat is de hele basis-URL.

API-sleutel aanvragen