HI ▾
API कुंजी पाएँ

किमी उपयोगकर्ताओं के लिए क्विकस्टार्ट

अपने मौजूदा OpenAI SDK कॉल को एक बिना सेंसर LLM पर रूट करने के लिए एक नया बेस URL और API कुंजी डालें। यह गाइड आपको दिखाती है कि शुरू करने के लिए आवश्यक सटीक तीन लाइनें क्या हैं, चैट, स्ट्रीमिंग और टूल्स का उपयोग करने के लिए हमारे कम्पैटिबल एंडपॉइंट के साथ।

आवश्यकताएं: API कुंजी

अनुरोध भेजने से पहले आपको एक API कुंजी की आवश्यकता है। Get API key पृष्ठ पर Continue with Google या ईमेल और पासवर्ड का उपयोग करके साइन अप करें। आपकी कुंजी तुरंत उपलब्ध हो जाती है। नए खातों को 7 दिनों के लिए मान्य $0.50 ट्रायल क्रेडिट मिलता है; कार्ड की आवश्यकता नहीं है। भुगतान वाले उपयोग के लिए, USDT (TRC20) या USDC (Base) से टॉप-अप करें। टॉप-अप $10 से $500 की सीमा में होते हैं। $50 या उससे अधिक के टॉप-अप पर +5% बोनस और $100 या उससे अधिक पर +10% बोनस मिलता है। क्रेडिट कभी समाप्त नहीं होता और केवल वास्तविक टोकन उपयोग के लिए चार्ज किया जाता है। त्रुटियाँ और अस्वीकृतियाँ मुफ़्त हैं। आप एक खाते के लिए एक सक्रिय कुंजी रख सकते हैं; नई कुंजी जनरेट करने से पुरानी कुंजी बदल जाती है। सभी अनुरोधों के लिए इस कुंजी का उपयोग Authorization हेडर में करें।

बेसिक चैट कम्पलीशन

kimi api एंडपॉइंट मानक OpenAI चैट-कम्पलीशन अनुरोध स्वीकार करता है। अपने क्लाइंट की बेस URL को https://api.kimiapi.cc/v1 पर सेट करें और अपनी कुंजी प्रदान करें। हम एक अकेले, समर्पित बिना सेंसर मॉडल की सेवा करते हैं जिसकी ID uncensored है। यह मॉडल ओपन-वेट है, हमारे सर्वर पर चलता है, और कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। यह GPT, Claude, Gemini या किसी अन्य विक्रेता का मॉडल नहीं है। आप प्रॉम्प्ट भेज सकते हैं और पाठ प्रतिक्रियाएँ प्राप्त कर सकते हैं। मॉडल 100,000-टोकन की कॉन्टेक्स्ट विंडो (प्रॉम्प्ट + पूर्णता) का समर्थन करता है। प्रति अनुरोध अधिकतम आउटपुट 16,000 टोकन है, या 2,048 यदि आप max_tokens सेट नहीं करते हैं। कोई एम्बेडिंग, छवि या ऑडियो जनरेट नहीं किया जाता है।

स्ट्रीमिंग रिस्पॉन्स

स्ट्रीमिंग के लिए Server-Sent Events (SSE) का उपयोग करें। API टोकन को जनरेट होते ही स्ट्रीम करता है। टोकन उपयोग की जानकारी स्ट्रीम के अंतिम चंक में शामिल होती है। इससे आपको पूर्ण प्रतिक्रिया की प्रतीक्षा किए बिना वास्तविक समय में लागत की निगरानी करने की अनुमति मिलती है। स्ट्रीमिंग सभी मानक OpenAI-संगत SDKs द्वारा समर्थित है। अपने अनुरोध में stream=true सेट करें। क्लाइंट को पाठ वाले डेल्टा ऑब्जेक्ट्स की एक श्रृंखला प्राप्त होगी। आप पूर्ण प्रतिक्रिया को पुनर्प्राप्त करने के लिए इन डेल्टा को संयोजित कर सकते हैं। यह उन चैट इंटरफेस के लिए आदर्श है जहाँ उपयोगकर्कर्ता तुरंत प्रतिक्रिया की उम्मीद करते हैं। kimi api प्रॉक्सी ओवरहेड से बचकर पूर्वानुमेय लेटेंसी सुनिश्चित करता है।

फ़ंक्शन कॉलिंग (टूल्स)

API फ़ंक्शन कॉलिंग, जिसे टूल्स भी कहा जाता है, का समर्थन करता है। आप अपने अनुरोध में टूल्स परिभाषित कर सकते हैं और मॉडल उचित होने पर संरचित तर्क लौटाएगा। टूल परिभाषाओं की एक सूची पास करने के लिए tools पैरामीटर का उपयोग करें। आप tool_choice का उपयोग टूल्स को मजबूर या स्वचालित रूप से चुनने के लिए भी कर सकते हैं। मॉडल टूल कॉल के साथ एक प्रतिक्रिया लौटाता है, जिसे आप बातचीत जारी रखने के लिए API को पास कर सकते हैं। इससे एजेंट्स या स्वचालित वर्कफ़्लो बनाने की सुविधा मिलती है। टूल परिभाषाएँ मानक OpenAI प्रारूप का पालन करती हैं। बिना सेंसर मॉडल टूल परिभाषाओं को सटीक रूप से संभालता है और मान्य उपयोग मामलों के लिए उनका उपयोग करने से इनकार नहीं करता है। कठोर आउटपुट फॉर्मेटिंग के लिए JSON मोड भी उपलब्ध है।

JSON मोड

कठोर आउटपुट वाली एप्लिकेशन के लिए JSON मोड का उपयोग करें। response_format को {"type": "json_object"} पर सेट करें। मॉडल एक मान्य JSON ऑब्जेक्ट लौटाने का प्रयास करेगा। यह डेटा पार्स करने, कॉन्फ़िगरेशन फ़ाइलें जनरेट करने या संरचित डेटा को अन्य सिस्टम में फ़ीड करने के लिए उपयोगी है। JSON मोड फ़ंक्शन कॉलिंग के साथ काम करता है। आप रचनात्मकता और निर्धारण को नियंत्रित करने के लिए temperature, top_p, stop, seed, presence_penalty, और frequency_penalty जैसे पैरामीटर भी सेट कर सकते हैं। ये पैरामीटर OpenAI-संगत क्लाइंट्स के लिए मानक हैं। अपने उपयोग मामले के आधार पर स्थिरता और रचनात्मकता के बीच संतुलन बनाने के लिए उन्हें समायोजित करें।

लिमिट, एरर और कॉन्टेक्स्ट

प्रत्येक API कुंजी प्रति मिनट 300 अनुरोधों और 8 समानांतर अनुरोधों तक सीमित है। अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए। यदि कुंजी अमान्य है, तो आपको 401 एरर मिलता है। यदि आपके पास क्रेडिट नहीं है, तो आपको 402 एरर मिलता है। यदि आप रेट लिमिट से अधिक हो जाते हैं, तो आपको 429 एरर मिलता है। एरर और रिफ्यूजल मुफ्त हैं, इसलिए विफल अनुरोधों के लिए आपको चार्ज नहीं किया जाता है। कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है। एक कठिन सामग्री सीमा लागू होती है: किशोरों के साथ यौन सामग्री वाले अनुरोध हमेशा रिफ्यूज किए जाते हैं। API केवल टेक्स्ट है। कोई एम्बेडिंग, इमेज या फाइन-ट्यूनिंग उपलब्ध नहीं है। अन्य वेंडर के मॉडल के लिए, वर्तमान कीमतों और लिमिट के लिए उनके दस्तावेज़ देखें। यह सेवा एक स्वतंत्र विकल्प है, उनसे संबद्ध नहीं है।

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

स्ट्रीमिंग

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
Base URLhttps://api.kimiapi.cc/v1
मॉडल IDuncensored
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
अनुरोध का आकार8 MB तक
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
बोनस$50 से +5%, $100 से +10%
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

कॉन्टेक्स्ट विंडो और आउटपुट सीमा क्या है?

प्रॉम्प्ट और कम्पलीशन मिलाकर कॉन्टेक्स्ट विंडो 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 16,000 टोकन है। यदि आप <code>max_tokens</code> सेट नहीं करते हैं, तो लिमिट 2,048 टोकन है।

मैं अपना क्रेडिट कैसे टॉप-अप करूं?

केवल क्रिप्टो का उपयोग करके टॉप-अप करें: USDT (TRC20) या USDC (Base)। स्वीकृत राशि $10 से $500 तक पूर्ण डॉलर में है। $50 या उससे अधिक के टॉप-अप पर आपको +5% बोनस मिलता है, और $100 या उससे अधिक पर +10% बोनस मिलता है। क्रेडिट कभी खत्म नहीं होता।

क्या यह आधिकारिक Kimi API है?

नहीं। यह एक स्वतंत्र सेवा है जो एक ओपनएआई-कम्पैटिबल एंडपॉइंट प्रदान करती है। हम एक अकेले बिना सेंसर मॉडल को सर्व करते हैं। हम Moonshot AI या किसी अन्य वेंडर से संबद्ध नहीं हैं। उनकी आधिकारिक API के लिए संबंधित वेंडर दस्तावेज़ देखें।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ