किमी उपयोगकर्ताओं के लिए क्विकस्टार्ट
अपने मौजूदा OpenAI SDK कॉल को एक बिना सेंसर LLM पर रूट करने के लिए एक नया बेस URL और API कुंजी डालें। यह गाइड आपको दिखाती है कि शुरू करने के लिए आवश्यक सटीक तीन लाइनें क्या हैं, चैट, स्ट्रीमिंग और टूल्स का उपयोग करने के लिए हमारे कम्पैटिबल एंडपॉइंट के साथ।
आवश्यकताएं: API कुंजी
अनुरोध भेजने से पहले आपको एक API कुंजी की आवश्यकता है। Get API key पृष्ठ पर Continue with Google या ईमेल और पासवर्ड का उपयोग करके साइन अप करें। आपकी कुंजी तुरंत उपलब्ध हो जाती है। नए खातों को 7 दिनों के लिए मान्य $0.50 ट्रायल क्रेडिट मिलता है; कार्ड की आवश्यकता नहीं है। भुगतान वाले उपयोग के लिए, USDT (TRC20) या USDC (Base) से टॉप-अप करें। टॉप-अप $10 से $500 की सीमा में होते हैं। $50 या उससे अधिक के टॉप-अप पर +5% बोनस और $100 या उससे अधिक पर +10% बोनस मिलता है। क्रेडिट कभी समाप्त नहीं होता और केवल वास्तविक टोकन उपयोग के लिए चार्ज किया जाता है। त्रुटियाँ और अस्वीकृतियाँ मुफ़्त हैं। आप एक खाते के लिए एक सक्रिय कुंजी रख सकते हैं; नई कुंजी जनरेट करने से पुरानी कुंजी बदल जाती है। सभी अनुरोधों के लिए इस कुंजी का उपयोगAuthorization हेडर में करें।
बेसिक चैट कम्पलीशन
kimi api एंडपॉइंट मानक OpenAI चैट-कम्पलीशन अनुरोध स्वीकार करता है। अपने क्लाइंट की बेस URL को https://api.kimiapi.cc/v1 पर सेट करें और अपनी कुंजी प्रदान करें। हम एक अकेले, समर्पित बिना सेंसर मॉडल की सेवा करते हैं जिसकी ID uncensored है। यह मॉडल ओपन-वेट है, हमारे सर्वर पर चलता है, और कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। यह GPT, Claude, Gemini या किसी अन्य विक्रेता का मॉडल नहीं है। आप प्रॉम्प्ट भेज सकते हैं और पाठ प्रतिक्रियाएँ प्राप्त कर सकते हैं। मॉडल 100,000-टोकन की कॉन्टेक्स्ट विंडो (प्रॉम्प्ट + पूर्णता) का समर्थन करता है। प्रति अनुरोध अधिकतम आउटपुट 16,000 टोकन है, या 2,048 यदि आप max_tokens सेट नहीं करते हैं। कोई एम्बेडिंग, छवि या ऑडियो जनरेट नहीं किया जाता है।
स्ट्रीमिंग रिस्पॉन्स
स्ट्रीमिंग के लिए Server-Sent Events (SSE) का उपयोग करें। API टोकन को जनरेट होते ही स्ट्रीम करता है। टोकन उपयोग की जानकारी स्ट्रीम के अंतिम चंक में शामिल होती है। इससे आपको पूर्ण प्रतिक्रिया की प्रतीक्षा किए बिना वास्तविक समय में लागत की निगरानी करने की अनुमति मिलती है। स्ट्रीमिंग सभी मानक OpenAI-संगत SDKs द्वारा समर्थित है। अपने अनुरोध मेंstream=true सेट करें। क्लाइंट को पाठ वाले डेल्टा ऑब्जेक्ट्स की एक श्रृंखला प्राप्त होगी। आप पूर्ण प्रतिक्रिया को पुनर्प्राप्त करने के लिए इन डेल्टा को संयोजित कर सकते हैं। यह उन चैट इंटरफेस के लिए आदर्श है जहाँ उपयोगकर्कर्ता तुरंत प्रतिक्रिया की उम्मीद करते हैं। kimi api प्रॉक्सी ओवरहेड से बचकर पूर्वानुमेय लेटेंसी सुनिश्चित करता है।
फ़ंक्शन कॉलिंग (टूल्स)
API फ़ंक्शन कॉलिंग, जिसे टूल्स भी कहा जाता है, का समर्थन करता है। आप अपने अनुरोध में टूल्स परिभाषित कर सकते हैं और मॉडल उचित होने पर संरचित तर्क लौटाएगा। टूल परिभाषाओं की एक सूची पास करने के लिएtools पैरामीटर का उपयोग करें। आप tool_choice का उपयोग टूल्स को मजबूर या स्वचालित रूप से चुनने के लिए भी कर सकते हैं। मॉडल टूल कॉल के साथ एक प्रतिक्रिया लौटाता है, जिसे आप बातचीत जारी रखने के लिए API को पास कर सकते हैं। इससे एजेंट्स या स्वचालित वर्कफ़्लो बनाने की सुविधा मिलती है। टूल परिभाषाएँ मानक OpenAI प्रारूप का पालन करती हैं। बिना सेंसर मॉडल टूल परिभाषाओं को सटीक रूप से संभालता है और मान्य उपयोग मामलों के लिए उनका उपयोग करने से इनकार नहीं करता है। कठोर आउटपुट फॉर्मेटिंग के लिए JSON मोड भी उपलब्ध है।
JSON मोड
कठोर आउटपुट वाली एप्लिकेशन के लिए JSON मोड का उपयोग करें।response_format को {"type": "json_object"} पर सेट करें। मॉडल एक मान्य JSON ऑब्जेक्ट लौटाने का प्रयास करेगा। यह डेटा पार्स करने, कॉन्फ़िगरेशन फ़ाइलें जनरेट करने या संरचित डेटा को अन्य सिस्टम में फ़ीड करने के लिए उपयोगी है। JSON मोड फ़ंक्शन कॉलिंग के साथ काम करता है। आप रचनात्मकता और निर्धारण को नियंत्रित करने के लिए temperature, top_p, stop, seed, presence_penalty, और frequency_penalty जैसे पैरामीटर भी सेट कर सकते हैं। ये पैरामीटर OpenAI-संगत क्लाइंट्स के लिए मानक हैं। अपने उपयोग मामले के आधार पर स्थिरता और रचनात्मकता के बीच संतुलन बनाने के लिए उन्हें समायोजित करें।
लिमिट, एरर और कॉन्टेक्स्ट
प्रत्येक API कुंजी प्रति मिनट 300 अनुरोधों और 8 समानांतर अनुरोधों तक सीमित है। अनुरोध बॉडी 8 MB से अधिक नहीं होनी चाहिए। यदि कुंजी अमान्य है, तो आपको 401 एरर मिलता है। यदि आपके पास क्रेडिट नहीं है, तो आपको 402 एरर मिलता है। यदि आप रेट लिमिट से अधिक हो जाते हैं, तो आपको 429 एरर मिलता है। एरर और रिफ्यूजल मुफ्त हैं, इसलिए विफल अनुरोधों के लिए आपको चार्ज नहीं किया जाता है। कॉन्टेक्स्ट विंडो कुल 100,000 टोकन है। एक कठिन सामग्री सीमा लागू होती है: किशोरों के साथ यौन सामग्री वाले अनुरोध हमेशा रिफ्यूज किए जाते हैं। API केवल टेक्स्ट है। कोई एम्बेडिंग, इमेज या फाइन-ट्यूनिंग उपलब्ध नहीं है। अन्य वेंडर के मॉडल के लिए, वर्तमान कीमतों और लिमिट के लिए उनके दस्तावेज़ देखें। यह सेवा एक स्वतंत्र विकल्प है, उनसे संबद्ध नहीं है।
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);स्ट्रीमिंग
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| Base URL | https://api.kimiapi.cc/v1 |
| मॉडल ID | uncensored |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| JSON मोड | response_format: {"type": "json_object"} |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| अनुरोध का आकार | 8 MB तक |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| बोनस | $50 से +5%, $100 से +10% |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
कॉन्टेक्स्ट विंडो और आउटपुट सीमा क्या है?
प्रॉम्प्ट और कम्पलीशन मिलाकर कॉन्टेक्स्ट विंडो 100,000 टोकन है। प्रति अनुरोध अधिकतम आउटपुट 16,000 टोकन है। यदि आप <code>max_tokens</code> सेट नहीं करते हैं, तो लिमिट 2,048 टोकन है।
मैं अपना क्रेडिट कैसे टॉप-अप करूं?
केवल क्रिप्टो का उपयोग करके टॉप-अप करें: USDT (TRC20) या USDC (Base)। स्वीकृत राशि $10 से $500 तक पूर्ण डॉलर में है। $50 या उससे अधिक के टॉप-अप पर आपको +5% बोनस मिलता है, और $100 या उससे अधिक पर +10% बोनस मिलता है। क्रेडिट कभी खत्म नहीं होता।
क्या यह आधिकारिक Kimi API है?
नहीं। यह एक स्वतंत्र सेवा है जो एक ओपनएआई-कम्पैटिबल एंडपॉइंट प्रदान करती है। हम एक अकेले बिना सेंसर मॉडल को सर्व करते हैं। हम Moonshot AI या किसी अन्य वेंडर से संबद्ध नहीं हैं। उनकी आधिकारिक API के लिए संबंधित वेंडर दस्तावेज़ देखें।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।