Panduan Cepat untuk Pengguna Kimi
Masukkan URL dasar dan kunci API baru untuk mengarahkan panggilan SDK OpenAI Anda ke LLM tanpa sensor. Panduan ini menunjukkan tiga baris tepat yang diperlukan untuk mulai mengobrol, streaming, dan menggunakan tools dengan endpoint kompatibel kami.
Prasyarat: Kunci API
Sebelum mengirim permintaan, Anda memerlukan kunci API. Daftar di halaman Dapatkan kunci API menggunakan Lanjutkan dengan Google atau email dan kata sandi. Kunci Anda muncul segera. Akun baru menerima $0.50 kredit uji coba yang berlaku selama 7 hari; tidak memerlukan kartu. Untuk penggunaan berbayar, isi saldo dengan USDT (TRC20) atau USDC (Base). Isi ulang berkisar antara $10 hingga $500. Anda mendapatkan bonus +5% untuk isi saldo $50 atau lebih, dan bonus +10% untuk $100 atau lebih. Saldo tidak pernah kedaluwarsa dan hanya dikenakan berdasarkan penggunaan token aktual. Kesalahan dan penolakan gratis. Anda dapat memegang satu kunci aktif per akun; membuat kunci baru akan menggantikan kunci lama. Gunakan kunci ini di headerAuthorization untuk semua permintaan.
Penyelesaian Obrolan Dasar
Endpointkimi api menerima permintaan chat-completion standar OpenAI. Atur URL dasar klien Anda ke https://api.kimiapi.cc/v1 dan berikan kunci Anda. Kami melayani satu model uncensored khusus yang diidentifikasi dengan ID uncensored. Model ini adalah model bobot terbuka, berjalan di server kami, dan tidak menolak topik dewasa, fiksi, atau kontroversial yang sah. Ini bukan GPT, Claude, Gemini, atau model vendor lain. Anda dapat mengirim prompt dan menerima respons teks. Model ini mendukung jendela konteks 100.000 token (prompt + completion). Output maksimum per permintaan adalah 32.000 token, atau 2.048 jika Anda tidak mengatur max_tokens. Tidak ada embedding, gambar, atau audio yang dihasilkan.
Respons Streaming
Gunakan Server-Sent Events (SSE) untuk streaming. API meng-stream token saat dihasilkan. Informasi penggunaan token disertakan dalam potongan terakhir stream. Ini memungkinkan Anda memantau biaya secara real-time tanpa menunggu respons penuh. Streaming didukung oleh semua SDK kompatibel OpenAI. Aturstream=true dalam permintaan Anda. Klien akan menerima serangkaian objek delta yang berisi teks. Anda dapat menggabungkan delta ini untuk memulihkan respons penuh. Ini ideal untuk antarmuka obrolan di mana pengguna mengharapkan umpan balik segera. kimi api memastikan latensi prediktif dengan menghindari overhead proxy.
Pemanggilan Fungsi (Tools)
API mendukung pemanggilan fungsi, juga dikenal sebagai tools. Anda dapat menentukan tools dalam permintaan Anda dan model akan mengembalikan argumen terstruktur ketika sesuai. Gunakan parametertools untuk meneruskan daftar definisi tools. Anda juga dapat menggunakan tool_choice untuk memaksa atau memilih tools secara otomatis. Model mengembalikan respons dengan tool calls, yang dapat Anda kirimkan kembali ke API untuk melanjutkan percakapan. Ini memungkinkan pembuatan agen atau alur kerja otomatis. Definisi tools mengikuti format standar OpenAI. Model tanpa sensor menangani definisi tools secara akurat tanpa menolak untuk menggunakannya untuk kasus penggunaan yang valid. Mode JSON juga tersedia untuk format output yang lebih ketat.
Mode JSON
Untuk aplikasi yang memerlukan output ketat, gunakan mode JSON. Aturresponse_format ke {"type": "json_object"}. Model akan mencoba mengembalikan objek JSON yang valid. Ini berguna untuk mengurai data, menghasilkan file konfigurasi, atau memasukkan data terstruktur ke sistem lain. Mode JSON berfungsi bersama pemanggilan fungsi. Anda juga dapat mengatur parameter seperti temperature, top_p, stop, seed, presence_penalty, dan frequency_penalty untuk mengontrol kreativitas dan determinisme. Parameter ini standar untuk klien kompatibel OpenAI. Sesuaikan untuk menyeimbangkan konsistensi dan kreativitas berdasarkan kasus penggunaan Anda.
Batas, Error & Konteks
Setiap kunci API dibatasi hingga 300 permintaan per menit dan 8 permintaan paralel. Badan permintaan tidak boleh melebihi 8 MB. Jika kunci tidak valid, Anda menerima error 401. Jika Anda tidak memiliki saldo, Anda menerima error 402. Jika Anda melebihi batas laju, Anda menerima error 429. Kesalahan dan penolakan gratis, sehingga Anda tidak dikenakan biaya untuk permintaan yang gagal. Jendela konteks adalah 100.000 token total. Batas konten keras berlaku: permintaan yang melibatkan konten seksual dengan anak di bawah umur selalu ditolak. API hanya teks. Tidak ada embedding, gambar, atau fine-tuning yang tersedia. Untuk model vendor lain, periksa dokumentasi mereka untuk harga dan batas saat ini. Layanan ini adalah alternatif independen, tidak berafiliasi dengan mereka.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Base URL | https://api.kimiapi.cc/v1 |
| ID model | uncensored |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Mode JSON | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Jendela konteks | 100.000 token (input + output) |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Ukuran permintaan | hingga 8 MB |
| Batas laju | 300 permintaan per menit per kunci |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Masuk | Google atau email dan kata sandi |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apa itu jendela konteks dan batas output?
Jendela konteks adalah 100.000 token untuk prompt dan completion gabungan. Output maksimum per permintaan adalah 32.000 token. Jika Anda tidak mengatur <code>max_tokens</code>, batasnya adalah 2.048 token.
Bagaimana cara mengisi saldo saya?
Isi saldo hanya menggunakan kripto: USDT (TRC20) atau USDC (Base). Jumlah yang diterima adalah dolar utuh mulai dari $10 hingga $500. Anda mendapatkan bonus +5% untuk isi ulang $50 atau lebih, dan bonus +10% untuk $100 atau lebih. Saldo tidak pernah kedaluwarsa.
Apakah ini API Kimi resmi?
Tidak. Ini adalah layanan independen yang menyediakan endpoint kompatibel OpenAI. Kami melayani satu model tanpa sensor. Kami tidak berafiliasi dengan Moonshot AI atau vendor lain. Periksa dokumentasi vendor masing-masing untuk API resmi mereka.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.