ES ▾
Obtener clave de API

Inicio rápido para usuarios de Kimi

Cambia la URL base y la clave de API para enrutar tus llamadas existentes del SDK de OpenAI a un LLM sin censura. Esta guía muestra las tres líneas exactas necesarias para iniciar chats, streaming y uso de herramientas con nuestro endpoint compatible.

Requisitos previos: clave de API

Antes de enviar peticiones, necesitas una clave de API. Regístrate en la página Obtener clave de API usando Continuar con Google o con un correo electrónico y contraseña. Tu clave aparece al instante. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días; no se requiere tarjeta. Para uso pagado, recarga con USDT (TRC20) o USDC (Base). Las recargas van desde $10 hasta $500. Recibes un bono del +5% para recargas de $50 o más, y un bono del +10% para $100 o más. El crédito no caduca y se cobra solo por el uso real de tokens. Los errores y los rechazos son gratuitos. Puedes tener una clave activa por cuenta; generar una nueva clave reemplaza a la anterior. Usa esta clave en el encabezado Authorization para todas las peticiones.

Completado básico de chat

El endpoint kimi api acepta peticiones estándar de chat-completion de OpenAI. Establece la URL base de tu cliente en https://api.kimiapi.cc/v1 y proporciona tu clave. Servimos un único modelo sin censura dedicado identificado por el ID uncensored. Este modelo es de pesos abiertos, se ejecuta en nuestros servidores y no rechaza temas adultos, ficticios o controversos legales. No es GPT, Claude, Gemini ni ningún otro modelo de proveedor. Puedes enviar prompts y recibir respuestas de texto. El modelo admite una ventana de contexto de 100.000 tokens (prompt + respuesta). La salida máxima por petición es de 32.000 tokens, o 2.048 si no estableces max_tokens. No se generan incrustaciones, imágenes ni audio.

Respuestas en streaming

Usa Server-Sent Events (SSE) para streaming. La API envía tokens a medida que se generan. La información de uso de tokens se incluye en el último fragmento del stream. Esto te permite monitorizar los costes en tiempo real sin esperar a la respuesta completa. El streaming es compatible con todos los SDK estándar compatibles con OpenAI. Establece stream=true en tu petición. El cliente recibirá una serie de objetos delta que contienen el texto. Puedes concatenar estos deltas para reconstruir la respuesta completa. Esto es ideal para interfaces de chat donde los usuarios esperan una respuesta inmediata. La kimi api garantiza una latencia predecible al evitar la sobrecarga de los proxies.

Llamadas a funciones (herramientas)

La API admite llamadas a funciones, también conocidas como herramientas. Puedes definir herramientas en tu petición y el modelo devolverá argumentos estructurados cuando sea apropiado. Usa el parámetro tools para pasar una lista de definiciones de herramientas. También puedes usar tool_choice para forzar o seleccionar automáticamente las herramientas. El modelo devuelve una respuesta con llamadas a herramientas, que puedes pasar de nuevo a la API para continuar la conversación. Esto permite construir agentes o flujos de trabajo automatizados. Las definiciones de herramientas siguen el formato estándar de OpenAI. El modelo sin censura maneja las definiciones de herramientas con precisión sin rechazar su uso para casos de uso válidos. El modo JSON también está disponible para un formato de salida más estricto.

Modo JSON

Para aplicaciones que requieren una salida estricta, usa el modo JSON. Establece response_format a {"type": "json_object"}. El modelo intentará devolver un objeto JSON válido. Esto es útil para analizar datos, generar archivos de configuración o alimentar datos estructurados en otros sistemas. El modo JSON funciona junto con las llamadas a funciones. También puedes establecer parámetros como temperature, top_p, stop, seed, presence_penalty y frequency_penalty para controlar la creatividad y la determinismo. Estos parámetros son estándar para clientes compatibles con OpenAI. Ajústalos para equilibrar la consistencia y la creatividad según tu caso de uso.

Límites, errores y contexto

Cada clave de API tiene un límite de 300 peticiones por minuto y 8 peticiones simultáneas. El cuerpo de la petición no debe superar los 8 MB. Si la clave no es válida, recibirás un error 401. Si no tienes crédito, recibirás un error 402. Si superas el límite de peticiones, recibirás un error 429. Los errores y las denegaciones son gratuitos, por lo que no se te cobra por las peticiones fallidas. La ventana de contexto es de 100.000 tokens en total. Se aplica un límite estricto de contenido: las peticiones que involucren contenido sexual con menores siempre se denegarán. La API es solo de texto. No hay embeddings, imágenes ni ajuste fino disponibles. Para los modelos de otros proveedores, consulta su documentación para ver los precios y límites actuales. Este servicio es una alternativa independiente, no afiliada a ellos.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Funciones y límites

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
Base URLhttps://api.kimiapi.cc/v1
ID del modelouncensored
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Modo JSONresponse_format: {"type": "json_object"}
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Tamaño de peticiónhasta 8 MB
Límite de peticiones300 por minuto por clave
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrencia8 peticiones a la vez por clave
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Bono+5 % desde $50, +10 % desde $100
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es la ventana de contexto y el límite de salida?

La ventana de contexto es de 100.000 tokens para el prompt y la respuesta combinados. La salida máxima por petición es de 32.000 tokens. Si no estableces <code>max_tokens</code>, el límite es de 2.048 tokens.

¿Cómo recargo mi crédito?

Recarga solo con cripto: USDT (TRC20) o USDC (Base). Las cantidades aceptadas son dólares enteros desde $10 hasta $500. Recibes un bono del +5% para recargas de $50 o más, y un bono del +10% para $100 o más. El crédito no caduca.

¿Es esta la API oficial de Kimi?

No. Este es un servicio independiente que proporciona un endpoint compatible con OpenAI. Ofrecemos un único modelo sin censura. No estamos afiliados con Moonshot AI ni con ningún otro proveedor. Consulta la documentación de cada proveedor para sus APIs oficiales.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API