API sans censure compatible OpenAI
API LLM sans filtre : alternative à Kimi
Une API prêt à l'emploi, compatible OpenAI, pour le modèle sans censure. Remplacez votre URL de base et votre clé API pour commencer à générer du texte sans refus de contenu.
- Prise en charge standard des SDK OpenAI
- Modèle unique dédié sans censure
- Pas d'abonnement, paiement par token
Essayez avec une seule requête
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);- 0,25 $par 1M de tokens d'entrée
- 1,00 $Tokens de sortie / 1M
- 100 000fenêtre de contexte en tokens
- 0,50 $crédit d'essai
- 300requêtes par minute
Ce que vous obtenez
Compatibilité intégrée
Fonctionne avec les SDK officiels OpenAI et tout client compatible en modifiant simplement l'URL de base et la clé API.
Streaming et outils
Prend en charge le streaming via SSE, l'appel de fonctions avec des outils et le mode JSON pour des réponses structurées.
Tarification transparente
Ne payez que pour l'utilisation réelle des tokens avec un crédit crypto prépayé qui n'expire jamais.
Sortie sans censure
Le modèle répond sans refus pour les sujets adultes légaux, fictifs ou controversés.
Configuration rapide
Obtenez votre clé API instantanément avec Google ou e-mail. Aucun numéro de téléphone n'est requis.
Confidentialité d'abord
Les prompts ne sont pas utilisés pour l'entraînement des données de votre modèle.
Comment ça marche
Obtenez votre clé
Inscrivez-vous avec Google ou e-mail pour recevoir votre clé API instantanément.
Mettre à jour la configuration
Définissez votre URL de base sur https://api.kimiapi.cc/v1 et ajoutez votre clé.
Commencer la génération
Envoyez des requêtes à /v1/chat/completions et recevez une sortie de texte sans censure.
Ce que les gens créent avec
Génération de contenu
Générez des histoires ou des articles créatifs sans tomber sur les filtres de contenu standard. Idéal pour les thèmes adultes ou les récits non conventionnels.
Recherche en sécurité
Invitez le modèle à trouver ses propres limites ou à générer des exemples de sujets restreints pour analyse.
Extraction de données
Utilisez le mode JSON pour extraire des données structurées à partir de texte sans interruptions de format dues aux couches de modération.
Applications de chat
Créez des interfaces de chat qui répondent naturellement à diverses entrées utilisateur sans refus inattendus.
Pourquoi choisir une alternative API Kimi sans censure
Lorsque les développeurs recherchent un endpoint kimi api ou des endpoints de grands modèles de langage similaires, ils rencontrent souvent des agrégateurs qui acheminent le trafic via plusieurs fournisseurs. Cela ajoute de la latence et de la complexité. Nous fournissons un seul modèle sans censure dédié via un endpoint standard compatible OpenAI. Cela garantit des performances prévisibles et une fidélité exacte du prompt.
Notre service est conçu pour les utilisateurs qui souhaitent une génération de texte fiable sans refus de contenu. Le modèle est à poids ouverts et ajusté pour répondre à un large éventail de sujets, y compris les sujets adultes ou controversés, pour un usage légal. Ce n'est pas GPT, Claude ou tout autre modèle de fournisseur. C'est un LLM distinct et indépendant fonctionnant sur nos serveurs.
Nous évitons la surcharge des agrégateurs. Vous avez un accès direct aux capacités du modèle. Cela est particulièrement utile pour les applications où la cohérence est plus importante que l'accès à une vaste bibliothèque de différents modèles.
Compatible OpenAI : Code intégré
Notre API suit la norme OpenAI Chat Completions. Vous pouvez utiliser les mêmes bibliothèques clientes que vous connaissez déjà. Cela réduit considérablement le temps d'intégration. Vous n'avez besoin de mettre à jour que deux valeurs de configuration : l'URL de base et la clé API.
L'endpoint est POST /v1/chat/completions. Il accepte les mêmes paramètres que l'API OpenAI, y compris temperature, top_p et les séquences d'arrêt. Nous supportons également l'appel de fonctions et le mode JSON pour des sorties structurées.
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Cette approche signifie que vous pouvez passer vos clients OpenAI existants à notre modèle sans censure avec des modifications de code minimales. Le format de réponse est identique, ce qui rend le débogage et les tests simples.
Modèle : LLM à poids ouverts sans censure
L'ID du modèle est uncensored. Il s'agit d'un modèle à poids ouverts de grand modèle de langage hébergé sur notre infrastructure. Il est affiné pour répondre sans refus de contenu pour une utilisation adulte légale. Il ne bloque pas les sujets créatifs ou controversés standards.
Cependant, il existe une limite stricte de contenu : les requêtes impliquant du contenu sexuel avec des mineurs sont toujours refusées. C'est le seul blocage strict appliqué par le modèle.
La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Vous pouvez spécifier une sortie maximale de 32 000 tokens par requête. Si vous ne définissez pas max_tokens, la limite par défaut est de 2 048 tokens.
Ce n'est pas un service de routage. Nous ne basculons pas entre différents modèles de fournisseurs. Vous bénéficiez d'un comportement cohérent avec ce modèle unique et dédié.
Tarification : paiement par token, sans abonnement
Nous facturons $0.25 par 1M de tokens d'entrée et $1.00 par 1M de tokens de sortie. Le crédit est prépayé et débité selon l'utilisation réelle des tokens. Les erreurs et les refus sont gratuits, vous ne payez que pour les complétions réussies.
Il n'y a pas d'abonnements mensuels ni de frais cachés. Votre crédit payé n'expire jamais. Vous pouvez recharger uniquement avec des cryptomonnaies : USDT (TRC20) ou USDC (Base). Le rechargement minimum est de 10 $, le maximum est de 500 $.
Nous offrons un bonus sur les recharges : +5 % de crédit pour des montants de 50 $ ou plus, et +10 % pour 100 $ ou plus. Nous n'acceptons pas les cartes, PayPal ou les virements bancaires. Chaque nouveau compte reçoit 0,50 $ de crédit d'essai gratuit valable 7 jours, sans carte nécessaire.
Fonctionnalités : streaming, outils, mode JSON
Notre API prend en charge les réponses en streaming via Server-Sent Events (SSE). Les informations sur l'utilisation des tokens sont incluses dans le dernier fragment du flux. Cela vous permet d'afficher les réponses en temps réel à vos utilisateurs.
L'appel de fonctions est entièrement pris en charge. Vous pouvez définir des outils et laisser le modèle décider quand les utiliser. C'est essentiel pour créer des agents capables d'interagir avec des systèmes externes.
Le mode JSON est disponible via le paramètre response_format. Définissez-le sur json_object pour forcer le modèle à produire du JSON valide. Cela est utile pour l'extraction de données ou la génération de contenu structuré.
Nous supportons les paramètres standards comme temperature, top_p, stop, seed, presence_penalty et frequency_penalty pour affiner la sortie.
Obtenez votre clé API maintenant
Inscrivez-vous en utilisant Continuer avec Google ou créez un compte avec une adresse e-mail et un mot de passe. Votre clé API est affichée immédiatement. Aucun numéro de téléphone n'est requis.
Chaque compte est limité à une clé active. Si vous générez une nouvelle clé, l'ancienne est remplacée. Vous pouvez effectuer jusqu'à 300 requêtes par minute par clé, avec une limite de concurrence de 8 requêtes simultanées. La limite de taille du corps de la requête est de 8 Mo.
Si vous rencontrez des problèmes, tels qu'un double débit, utilisez la page Support. Le crédit n'est pas remboursé car il n'expire jamais, mais nous corrigerons les erreurs comptables.
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Ceci est une API pour les développeurs. Nous ne proposons pas de site web ou d'application de chat. Nous ne fournissons pas de SLA, de certifications SOC2 ou HIPAA. Nous ne proposons pas de déploiement sur site. Si vous avez besoin de cela, ce n'est pas le bon choix pour vous.
Questions et réponses
S'agit-il de l'API officielle Kimi ?
Non, nous sommes un service indépendant. Nous ne sommes pas affiliés à la marque Kimi ni à ses créateurs. Nous proposons un endpoint compatible OpenAI pour notre propre modèle sans censure. Si vous recherchez l'API officielle Kimi, consultez la documentation de Moonshot AI.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 100 000 tokens, ce qui inclut à la fois le prompt et la complétion. Vous pouvez spécifier une sortie maximale de 32 000 tokens par requête. Si vous ne définissez pas max_tokens, la limite est de 2 048 tokens.
Comment payer l'API ?
Nous n'acceptons que les cryptomonnaies : USDT (TRC20) ou USDC (Base). Vous pouvez recharger n'importe quel montant entier de 10 $ à 500 $. Vous recevez un crédit bonus pour les recharges plus importantes. Nous n'acceptons pas les cartes de crédit, PayPal ni les virements bancaires.
L'API prend-elle en charge le streaming ?
Oui, nous prenons en charge le streaming via Server-Sent Events (SSE). Les informations sur l'utilisation des tokens sont fournies dans le dernier fragment du flux. Cela vous permet d'afficher les réponses en temps réel.
Mes données sont-elles utilisées pour l'entraînement ?
Non, vos prompts ne sont pas utilisés pour l'entraînement. Nous avons seulement besoin de votre adresse e-mail pour créer votre compte. Vous pouvez vous inscrire avec Google ou avec une adresse e-mail et un mot de passe. Aucun numéro de téléphone n'est requis.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.