Inicio rápido para usuarios de Kimi
Cambia la URL base y la clave de API para enrutar tus llamadas existentes del SDK de OpenAI a un LLM sin censura. Esta guía muestra las tres líneas exactas necesarias para iniciar chats, streaming y uso de herramientas con nuestro endpoint compatible.
Requisitos previos: clave de API
Antes de enviar peticiones, necesitas una clave de API. Regístrate en la página Obtener clave de API usando Continuar con Google o con un correo electrónico y contraseña. Tu clave aparece al instante. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días; no se requiere tarjeta. Para uso pagado, recarga con USDT (TRC20) o USDC (Base). Las recargas van desde $10 hasta $500. Recibes un bono del +5% para recargas de $50 o más, y un bono del +10% para $100 o más. El crédito no caduca y se cobra solo por el uso real de tokens. Los errores y los rechazos son gratuitos. Puedes tener una clave activa por cuenta; generar una nueva clave reemplaza a la anterior. Usa esta clave en el encabezadoAuthorization para todas las peticiones.
Completado básico de chat
El endpointkimi api acepta peticiones estándar de chat-completion de OpenAI. Establece la URL base de tu cliente en https://api.kimiapi.cc/v1 y proporciona tu clave. Servimos un único modelo sin censura dedicado identificado por el ID uncensored. Este modelo es de pesos abiertos, se ejecuta en nuestros servidores y no rechaza temas adultos, ficticios o controversos legales. No es GPT, Claude, Gemini ni ningún otro modelo de proveedor. Puedes enviar prompts y recibir respuestas de texto. El modelo admite una ventana de contexto de 100.000 tokens (prompt + respuesta). La salida máxima por petición es de 32.000 tokens, o 2.048 si no estableces max_tokens. No se generan incrustaciones, imágenes ni audio.
Respuestas en streaming
Usa Server-Sent Events (SSE) para streaming. La API envía tokens a medida que se generan. La información de uso de tokens se incluye en el último fragmento del stream. Esto te permite monitorizar los costes en tiempo real sin esperar a la respuesta completa. El streaming es compatible con todos los SDK estándar compatibles con OpenAI. Establecestream=true en tu petición. El cliente recibirá una serie de objetos delta que contienen el texto. Puedes concatenar estos deltas para reconstruir la respuesta completa. Esto es ideal para interfaces de chat donde los usuarios esperan una respuesta inmediata. La kimi api garantiza una latencia predecible al evitar la sobrecarga de los proxies.
Llamadas a funciones (herramientas)
La API admite llamadas a funciones, también conocidas como herramientas. Puedes definir herramientas en tu petición y el modelo devolverá argumentos estructurados cuando sea apropiado. Usa el parámetrotools para pasar una lista de definiciones de herramientas. También puedes usar tool_choice para forzar o seleccionar automáticamente las herramientas. El modelo devuelve una respuesta con llamadas a herramientas, que puedes pasar de nuevo a la API para continuar la conversación. Esto permite construir agentes o flujos de trabajo automatizados. Las definiciones de herramientas siguen el formato estándar de OpenAI. El modelo sin censura maneja las definiciones de herramientas con precisión sin rechazar su uso para casos de uso válidos. El modo JSON también está disponible para un formato de salida más estricto.
Modo JSON
Para aplicaciones que requieren una salida estricta, usa el modo JSON. Estableceresponse_format a {"type": "json_object"}. El modelo intentará devolver un objeto JSON válido. Esto es útil para analizar datos, generar archivos de configuración o alimentar datos estructurados en otros sistemas. El modo JSON funciona junto con las llamadas a funciones. También puedes establecer parámetros como temperature, top_p, stop, seed, presence_penalty y frequency_penalty para controlar la creatividad y la determinismo. Estos parámetros son estándar para clientes compatibles con OpenAI. Ajústalos para equilibrar la consistencia y la creatividad según tu caso de uso.
Límites, errores y contexto
Cada clave de API tiene un límite de 300 peticiones por minuto y 8 peticiones simultáneas. El cuerpo de la petición no debe superar los 8 MB. Si la clave no es válida, recibirás un error 401. Si no tienes crédito, recibirás un error 402. Si superas el límite de peticiones, recibirás un error 429. Los errores y las denegaciones son gratuitos, por lo que no se te cobra por las peticiones fallidas. La ventana de contexto es de 100.000 tokens en total. Se aplica un límite estricto de contenido: las peticiones que involucren contenido sexual con menores siempre se denegarán. La API es solo de texto. No hay embeddings, imágenes ni ajuste fino disponibles. Para los modelos de otros proveedores, consulta su documentación para ver los precios y límites actuales. Este servicio es una alternativa independiente, no afiliada a ellos.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Funciones y límites
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Base URL | https://api.kimiapi.cc/v1 |
| ID del modelo | uncensored |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Modo JSON | response_format: {"type": "json_object"} |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Tamaño de petición | hasta 8 MB |
| Límite de peticiones | 300 por minuto por clave |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Cuál es la ventana de contexto y el límite de salida?
La ventana de contexto es de 100.000 tokens para el prompt y la respuesta combinados. La salida máxima por petición es de 32.000 tokens. Si no estableces <code>max_tokens</code>, el límite es de 2.048 tokens.
¿Cómo recargo mi crédito?
Recarga solo con cripto: USDT (TRC20) o USDC (Base). Las cantidades aceptadas son dólares enteros desde $10 hasta $500. Recibes un bono del +5% para recargas de $50 o más, y un bono del +10% para $100 o más. El crédito no caduca.
¿Es esta la API oficial de Kimi?
No. Este es un servicio independiente que proporciona un endpoint compatible con OpenAI. Ofrecemos un único modelo sin censura. No estamos afiliados con Moonshot AI ni con ningún otro proveedor. Consulta la documentación de cada proveedor para sus APIs oficiales.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.