DE ▾
API-Schlüssel erhalten

Schnellstart für Kimi-Nutzer

Setze eine neue Base-URL und einen API-Schlüssel ein, um deine bestehenden OpenAI-SDK-Aufrufe an eine unzensierte LLM zu leiten. Diese Anleitung zeigt die drei Zeilen, die du für Chat, Streaming und Tools mit unserem kompatiblen Endpunkt benötigst.

Voraussetzungen: API-Schlüssel

Bevor du Anfragen sendest, benötigst du einen API-Schlüssel. Registriere dich auf der Seite API-Schlüssel erhalten mit Weiter mit Google oder E-Mail und Passwort. Dein Schlüssel erscheint sofort. Neue Konten erhalten $0,50 an Testguthaben, die 7 Tage gültig sind; keine Karte erforderlich. Für bezahlte Nutzung lade mit USDT (TRC20) oder USDC (Base) auf. Aufladungen reichen von $10 bis $500. Du erhältst einen +5%-Bonus für Aufladungen von $50 oder mehr und einen +10%-Bonus für $100 oder mehr. Guthaben verfällt nie und wird nur für tatsächliche Token-Nutzung berechnet. Fehler und Ablehnungen sind kostenlos. Du kannst einen aktiven Schlüssel pro Konto halten; das Erzeugen eines neuen Schlüssels ersetzt den alten. Verwende diesen Schlüssel im Authorization-Header für alle Anfragen.

Basis-Chat-Vervollständigung

Der kimi api-Endpunkt akzeptiert standardmäßige OpenAI-Chat-Vervollständigungsanfragen. Lege die Base-URL deines Clients auf https://api.kimiapi.cc/v1 fest und gib deinen Schlüssel an. Wir bieten ein einzelnes, dediziertes unzensiertes Modell an, das durch die ID uncensored identifiziert wird. Dieses Modell ist Open-Weight, läuft auf unseren Servern und lehnt legale erwachsene, fiktive oder kontroverse Themen nicht ab. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Du kannst Prompts senden und Textantworten erhalten. Das Modell unterstützt ein Kontextfenster von 100.000 Token (Prompt + Vervollständigung). Die maximale Ausgabe pro Anfrage beträgt 32.000 Token oder 2.048, wenn du max_tokens nicht festlegst. Es werden keine Embeddings, Bilder oder Audio generiert.

Streaming-Antworten

Verwende Server-Sent Events (SSE) für Streaming. Die API streamt Token, sobald sie generiert werden. Token-Nutzungsinformationen sind im letzten Chunk des Streams enthalten. Dies ermöglicht es dir, die Kosten in Echtzeit zu überwachen, ohne auf die vollständige Antwort zu warten. Streaming wird von allen standardmäßigen OpenAI-kompatiblen SDKs unterstützt. Setze stream=true in deiner Anfrage. Der Client erhält eine Reihe von Delta-Objekten, die den Text enthalten. Du kannst diese Deltas verketten, um die vollständige Antwort wiederherzustellen. Dies ist ideal für Chat-Schnittstellen, bei denen Benutzer sofortiges Feedback erwarten. Die kimi api sorgt für vorhersehbare Latenz, indem Proxy-Overhead vermieden wird.

Function Calling (Tools)

Die API unterstützt Function Calling, auch bekannt als Tools. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt bei Bedarf strukturierte Argumente zurück. Verwende den Parameter tools, um eine Liste von Tool-Definitionen zu übergeben. Du kannst auch tool_choice verwenden, um Tools zu erzwingen oder automatisch auszuwählen. Das Modell gibt eine Antwort mit Tool-Aufrufen zurück, die du an die API zurückgeben kannst, um das Gespräch fortzusetzen. Dies ermöglicht den Aufbau von Agents oder automatisierten Workflows. Die Tool-Definitionen folgen dem standardmäßigen OpenAI-Format. Das unzensierte Modell verarbeitet Tool-Definitionen genau, ohne sie für gültige Anwendungsfälle abzulehnen. Der JSON-Modus ist ebenfalls für strengere Ausgabeformatierungen verfügbar.

JSON-Modus

Für Anwendungen, die strenge Ausgaben erfordern, verwende den JSON-Modus. Setze response_format auf {"type": "json_object"}. Das Modell wird versuchen, ein gültiges JSON-Objekt zurückzugeben. Dies ist nützlich zum Parsen von Daten, Generieren von Konfigurationsdateien oder Zuführen strukturierter Daten an andere Systeme. Der JSON-Modus funktioniert neben Function Calling. Du kannst auch Parameter wie temperature, top_p, stop, seed, presence_penalty und frequency_penalty festlegen, um Kreativität und Determinismus zu steuern. Diese Parameter sind standardmäßig für OpenAI-kompatible Clients. Passe sie an, um Konsistenz und Kreativität basierend auf deinem Anwendungsfall auszubalancieren.

Limits, Fehler & Kontext

Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 parallele Anfragen begrenzt. Der Anfragekörper darf 8 MB nicht überschreiten. Bei ungültigem Schlüssel erhältst du einen 401-Fehler. Bei keinem Guthaben erhältst du einen 402-Fehler. Bei Überschreitung des Ratenlimits erhältst du einen 429-Fehler. Fehler und Ablehnungen sind kostenlos, sodass du für fehlgeschlagene Anfragen nicht belastet wirst. Das Kontextfenster beträgt insgesamt 100.000 Token. Es gilt eine harte Inhaltsgrenze: Anfragen mit sexuellem Inhalt mit Minderjährigen werden immer abgelehnt. Die API ist textbasiert. Keine Embeddings, Bilder oder Fine-Tuning verfügbar. Für Modelle anderer Anbieter prüfe deren Dokumentation zu aktuellen Preisen und Limits. Dieser Dienst ist eine unabhängige Alternative, nicht mit diesen Anbietern verbunden.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Base-URLhttps://api.kimiapi.cc/v1
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
EndpunktePOST /v1/chat/completions · GET /v1/models
JSON-Modusresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Was ist das Kontextfenster und die Ausgabelimit?

Das Kontextfenster umfasst 100.000 Token für Prompt und Antwort zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token. Wenn du <code>max_tokens</code> nicht setzt, liegt das Limit bei 2.048 Token.

Wie lade ich mein Guthaben auf?

Lade nur per Krypto auf: USDT (TRC20) oder USDC (Base). Akzeptierte Beträge sind volle Dollar von $10 bis $500. Du erhältst einen +5%-Bonus für Aufladungen ab $50 und einen +10%-Bonus ab $100. Guthaben verfällt nie.

Ist dies die offizielle Kimi API?

Nein. Dies ist ein unabhängiger Dienst, der einen OpenAI-kompatiblen Endpunkt bereitstellt. Wir bieten ein einzelnes unzensiertes Modell an. Wir sind nicht mit Moonshot AI oder einem anderen Anbieter verbunden. Prüfe die Dokumentation der jeweiligen Anbieter für deren offizielle APIs.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten