Schnellstart für Kimi-Nutzer
Setze eine neue Base-URL und einen API-Schlüssel ein, um deine bestehenden OpenAI-SDK-Aufrufe an eine unzensierte LLM zu leiten. Diese Anleitung zeigt die drei Zeilen, die du für Chat, Streaming und Tools mit unserem kompatiblen Endpunkt benötigst.
Voraussetzungen: API-Schlüssel
Bevor du Anfragen sendest, benötigst du einen API-Schlüssel. Registriere dich auf der Seite API-Schlüssel erhalten mit Weiter mit Google oder E-Mail und Passwort. Dein Schlüssel erscheint sofort. Neue Konten erhalten $0,50 an Testguthaben, die 7 Tage gültig sind; keine Karte erforderlich. Für bezahlte Nutzung lade mit USDT (TRC20) oder USDC (Base) auf. Aufladungen reichen von $10 bis $500. Du erhältst einen +5%-Bonus für Aufladungen von $50 oder mehr und einen +10%-Bonus für $100 oder mehr. Guthaben verfällt nie und wird nur für tatsächliche Token-Nutzung berechnet. Fehler und Ablehnungen sind kostenlos. Du kannst einen aktiven Schlüssel pro Konto halten; das Erzeugen eines neuen Schlüssels ersetzt den alten. Verwende diesen Schlüssel imAuthorization-Header für alle Anfragen.
Basis-Chat-Vervollständigung
Derkimi api-Endpunkt akzeptiert standardmäßige OpenAI-Chat-Vervollständigungsanfragen. Lege die Base-URL deines Clients auf https://api.kimiapi.cc/v1 fest und gib deinen Schlüssel an. Wir bieten ein einzelnes, dediziertes unzensiertes Modell an, das durch die ID uncensored identifiziert wird. Dieses Modell ist Open-Weight, läuft auf unseren Servern und lehnt legale erwachsene, fiktive oder kontroverse Themen nicht ab. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Du kannst Prompts senden und Textantworten erhalten. Das Modell unterstützt ein Kontextfenster von 100.000 Token (Prompt + Vervollständigung). Die maximale Ausgabe pro Anfrage beträgt 32.000 Token oder 2.048, wenn du max_tokens nicht festlegst. Es werden keine Embeddings, Bilder oder Audio generiert.
Streaming-Antworten
Verwende Server-Sent Events (SSE) für Streaming. Die API streamt Token, sobald sie generiert werden. Token-Nutzungsinformationen sind im letzten Chunk des Streams enthalten. Dies ermöglicht es dir, die Kosten in Echtzeit zu überwachen, ohne auf die vollständige Antwort zu warten. Streaming wird von allen standardmäßigen OpenAI-kompatiblen SDKs unterstützt. Setzestream=true in deiner Anfrage. Der Client erhält eine Reihe von Delta-Objekten, die den Text enthalten. Du kannst diese Deltas verketten, um die vollständige Antwort wiederherzustellen. Dies ist ideal für Chat-Schnittstellen, bei denen Benutzer sofortiges Feedback erwarten. Die kimi api sorgt für vorhersehbare Latenz, indem Proxy-Overhead vermieden wird.
Function Calling (Tools)
Die API unterstützt Function Calling, auch bekannt als Tools. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt bei Bedarf strukturierte Argumente zurück. Verwende den Parametertools, um eine Liste von Tool-Definitionen zu übergeben. Du kannst auch tool_choice verwenden, um Tools zu erzwingen oder automatisch auszuwählen. Das Modell gibt eine Antwort mit Tool-Aufrufen zurück, die du an die API zurückgeben kannst, um das Gespräch fortzusetzen. Dies ermöglicht den Aufbau von Agents oder automatisierten Workflows. Die Tool-Definitionen folgen dem standardmäßigen OpenAI-Format. Das unzensierte Modell verarbeitet Tool-Definitionen genau, ohne sie für gültige Anwendungsfälle abzulehnen. Der JSON-Modus ist ebenfalls für strengere Ausgabeformatierungen verfügbar.
JSON-Modus
Für Anwendungen, die strenge Ausgaben erfordern, verwende den JSON-Modus. Setzeresponse_format auf {"type": "json_object"}. Das Modell wird versuchen, ein gültiges JSON-Objekt zurückzugeben. Dies ist nützlich zum Parsen von Daten, Generieren von Konfigurationsdateien oder Zuführen strukturierter Daten an andere Systeme. Der JSON-Modus funktioniert neben Function Calling. Du kannst auch Parameter wie temperature, top_p, stop, seed, presence_penalty und frequency_penalty festlegen, um Kreativität und Determinismus zu steuern. Diese Parameter sind standardmäßig für OpenAI-kompatible Clients. Passe sie an, um Konsistenz und Kreativität basierend auf deinem Anwendungsfall auszubalancieren.
Limits, Fehler & Kontext
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 parallele Anfragen begrenzt. Der Anfragekörper darf 8 MB nicht überschreiten. Bei ungültigem Schlüssel erhältst du einen 401-Fehler. Bei keinem Guthaben erhältst du einen 402-Fehler. Bei Überschreitung des Ratenlimits erhältst du einen 429-Fehler. Fehler und Ablehnungen sind kostenlos, sodass du für fehlgeschlagene Anfragen nicht belastet wirst. Das Kontextfenster beträgt insgesamt 100.000 Token. Es gilt eine harte Inhaltsgrenze: Anfragen mit sexuellem Inhalt mit Minderjährigen werden immer abgelehnt. Die API ist textbasiert. Keine Embeddings, Bilder oder Fine-Tuning verfügbar. Für Modelle anderer Anbieter prüfe deren Dokumentation zu aktuellen Preisen und Limits. Dieser Dienst ist eine unabhängige Alternative, nicht mit diesen Anbietern verbunden.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Base-URL | https://api.kimiapi.cc/v1 |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Was ist das Kontextfenster und die Ausgabelimit?
Das Kontextfenster umfasst 100.000 Token für Prompt und Antwort zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Wenn du <code>max_tokens</code> nicht setzt, liegt das Limit bei 2.048 Token.
Wie lade ich mein Guthaben auf?
Lade nur per Krypto auf: USDT (TRC20) oder USDC (Base). Akzeptierte Beträge sind volle Dollar von $10 bis $500. Du erhältst einen +5%-Bonus für Aufladungen ab $50 und einen +10%-Bonus ab $100. Guthaben verfällt nie.
Ist dies die offizielle Kimi API?
Nein. Dies ist ein unabhängiger Dienst, der einen OpenAI-kompatiblen Endpunkt bereitstellt. Wir bieten ein einzelnes unzensiertes Modell an. Wir sind nicht mit Moonshot AI oder einem anderen Anbieter verbunden. Prüfe die Dokumentation der jeweiligen Anbieter für deren offizielle APIs.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Base-URL. Das ist die gesamte Einrichtung.