Snelstart voor Kimi-gebruikers
Voeg een nieuwe base URL en API-sleutel toe om je bestaande OpenAI SDK-aanroepen te routeren naar een ongecensureerde LLM. Deze gids toont de exacte drie regels die nodig zijn om te beginnen met chatten, streaming en het gebruiken van tools met ons compatibele endpoint.
Vereisten: API-sleutel
Voordat je verzoeken stuurt, heb je een API-sleutel nodig. Meld je aan op de pagina API-sleutel ophalen met Doorgaan met Google of een e-mailadres en wachtwoord. Je sleutel verschijnt direct. Nieuwe accounts ontvangen $0,50 aan gratis proeftegoed dat 7 dagen geldig is; er is geen creditcard nodig. Voor betaald gebruik laad je op met USDT (TRC20) of USDC (Base). Stortingen variëren van $10 tot $500. Je ontvangt een bonus van +5% voor stortingen van $50 of meer, en een bonus van +10% voor $100 of meer. Het tegoed vervalt nooit en wordt alleen in rekening gebracht voor daadwerkelijk token-gebruik. Fouten en weigeringen zijn gratis. Je kunt één actieve sleutel per account hebben; het genereren van een nieuwe sleutel vervangt de oude. Gebruik deze sleutel in deAuthorization-header voor alle verzoeken.
Basis chatcompletie
Hetkimi api-endpoint accepteert standaard OpenAI chat-completie-verzoeken. Stel de basis-URL van je client in op https://api.kimiapi.cc/v1 en lever je sleutel. Wij bieden één toegewijd ongecensureerd model aan, geïdentificeerd door de ID uncensored. Dit model is een open-weight model, draait op onze servers en weigert geen wettelijke volwassen, fictieve of controversiële onderwerpen. Het is geen GPT, Claude, Gemini of een model van een andere leverancier. Je kunt prompts versturen en tekstantwoorden ontvangen. Het model ondersteunt een contextvenster van 100.000 tokens (prompt + antwoord). De maximale uitvoer per verzoek is 32.000 tokens, of 2.048 als je max_tokens niet instelt. Er worden geen embeddings, afbeeldingen of audio gegenereerd.
Streaming-antwoorden
Gebruik Server-Sent Events (SSE) voor streaming. De API streamt tokens zodra ze gegenereerd zijn. Token-gebruiksinformatie is opgenomen in het laatste chunk van de stream. Dit stelt je in staat kosten in realtime te monitoren zonder te wachten op de volledige respons. Streaming wordt ondersteund door alle standaard OpenAI-compatible SDK's. Stelstream=true in je verzoek in. De client ontvangt een reeks delta-objecten met de tekst. Je kunt deze deltas concatenen om de volledige respons te reconstrueren. Dit is ideaal voor chatinterfaces waar gebruikers directe feedback verwachten. De kimi api zorgt voor voorspelbare latentie door proxy-overhead te vermijden.
Function calling (tools)
De API ondersteunt function calling, ook wel tools genoemd. Je kunt tools definiëren in je verzoek en het model geeft gestructureerde argumenten terug wanneer dit gepast is. Gebruik de parametertools om een lijst met tool-definities door te geven. Je kunt ook tool_choice gebruiken om tools te forceren of automatisch te selecteren. Het model retourneert een antwoord met tool calls, die je terug kunt sturen naar de API om het gesprek voort te zetten. Dit stelt je in staat agents of geautomatiseerde workflows te bouwen. De tool-definities volgen de standaard OpenAI-indeling. Het ongecensureerde model verwerkt tool-definities nauwkeurig zonder ze te weigeren voor geldige toepassingen. JSON-modus is ook beschikbaar voor strengere uitvoerindeling.
JSON-modus
Voor toepassingen die een strenge uitvoer vereisen, gebruik je JSON-modus. Stelresponse_format in op {"type": "json_object"}. Het model zal proberen een geldig JSON-object te retourneren. Dit is nuttig voor het parseren van data, het genereren van configuratiebestanden of het voeden van gestructureerde data in andere systemen. JSON-modus werkt samen met function calling. Je kunt ook parameters instellen zoals temperature, top_p, stop, seed, presence_penalty en frequency_penalty om creativiteit en determinisme te regelen. Deze parameters zijn standaard voor OpenAI-compatibele clients. Pas ze aan om consistentie en creativiteit af te stemmen op jouw gebruikssituatie.
Limieten, Fouten & Context
Elke API-sleutel is beperkt tot 300 verzoeken per minuut en 8 gelijktijdige verzoeken. De requestbody mag niet groter zijn dan 8 MB. Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen tegoed hebt, ontvang je een 402-fout. Als je de rate limit overschrijdt, ontvang je een 429-fout. Fouten en weigeringen zijn gratis, dus je wordt niet in rekening gebracht voor mislukte verzoeken. Het contextvenster is 100.000 tokens in totaal. Er geldt een harde inhoudsgrens: verzoeken die seksuele inhoud met minderjarigen bevatten, worden altijd geweigerd. De API is alleen voor tekst. Er zijn geen embeddings, afbeeldingen of fine-tuning beschikbaar. Voor modellen van andere leveranciers raadpleeg je hun documentatie voor huidige prijzen en limieten. Deze dienst is een onafhankelijk alternatief, niet gelieerd aan hen.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.kimiapi.cc/v1 |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| JSON-modus | response_format: {"type": "json_object"} |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat is het contextvenster en de outputlimiet?
Het contextvenster is 100.000 tokens voor de prompt en het antwoord samen. De maximale uitvoer per verzoek is 32.000 tokens. Als je <code>max_tokens</code> niet instelt, is de limiet 2.048 tokens.
Hoe laad ik mijn tegoed op?
Laad tegoed op met alleen crypto: USDT (TRC20) of USDC (Base). Geaccepteerde bedragen zijn hele dollars van $10 tot $500. Je ontvangt een bonus van +5% voor stortingen van $50 of meer, en een bonus van +10% voor $100 of meer. Credit vervalt nooit.
Is dit de officiële Kimi API?
Nee. Dit is een onafhankelijke service die een OpenAI-compatible endpoint biedt. We serveren één ongecensureerd model. We zijn niet gelieerd aan Moonshot AI of een andere leverancier. Controleer de documentatie van de respectievelijke leverancier voor hun officiële API's.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, verander de basis-URL. Dat is de hele basis-URL.