ID ▾
Dapatkan kunci API

Panduan Cepat untuk Pengguna Kimi

Masukkan URL dasar dan kunci API baru untuk mengarahkan panggilan SDK OpenAI Anda ke LLM tanpa sensor. Panduan ini menunjukkan tiga baris tepat yang diperlukan untuk mulai mengobrol, streaming, dan menggunakan tools dengan endpoint kompatibel kami.

Prasyarat: Kunci API

Sebelum mengirim permintaan, Anda memerlukan kunci API. Daftar di halaman Dapatkan kunci API menggunakan Lanjutkan dengan Google atau email dan kata sandi. Kunci Anda muncul segera. Akun baru menerima $0.50 kredit uji coba yang berlaku selama 7 hari; tidak memerlukan kartu. Untuk penggunaan berbayar, isi saldo dengan USDT (TRC20) atau USDC (Base). Isi ulang berkisar antara $10 hingga $500. Anda mendapatkan bonus +5% untuk isi saldo $50 atau lebih, dan bonus +10% untuk $100 atau lebih. Saldo tidak pernah kedaluwarsa dan hanya dikenakan berdasarkan penggunaan token aktual. Kesalahan dan penolakan gratis. Anda dapat memegang satu kunci aktif per akun; membuat kunci baru akan menggantikan kunci lama. Gunakan kunci ini di header Authorization untuk semua permintaan.

Penyelesaian Obrolan Dasar

Endpoint kimi api menerima permintaan chat-completion standar OpenAI. Atur URL dasar klien Anda ke https://api.kimiapi.cc/v1 dan berikan kunci Anda. Kami melayani satu model uncensored khusus yang diidentifikasi dengan ID uncensored. Model ini adalah model bobot terbuka, berjalan di server kami, dan tidak menolak topik dewasa, fiksi, atau kontroversial yang sah. Ini bukan GPT, Claude, Gemini, atau model vendor lain. Anda dapat mengirim prompt dan menerima respons teks. Model ini mendukung jendela konteks 100.000 token (prompt + completion). Output maksimum per permintaan adalah 32.000 token, atau 2.048 jika Anda tidak mengatur max_tokens. Tidak ada embedding, gambar, atau audio yang dihasilkan.

Respons Streaming

Gunakan Server-Sent Events (SSE) untuk streaming. API meng-stream token saat dihasilkan. Informasi penggunaan token disertakan dalam potongan terakhir stream. Ini memungkinkan Anda memantau biaya secara real-time tanpa menunggu respons penuh. Streaming didukung oleh semua SDK kompatibel OpenAI. Atur stream=true dalam permintaan Anda. Klien akan menerima serangkaian objek delta yang berisi teks. Anda dapat menggabungkan delta ini untuk memulihkan respons penuh. Ini ideal untuk antarmuka obrolan di mana pengguna mengharapkan umpan balik segera. kimi api memastikan latensi prediktif dengan menghindari overhead proxy.

Pemanggilan Fungsi (Tools)

API mendukung pemanggilan fungsi, juga dikenal sebagai tools. Anda dapat menentukan tools dalam permintaan Anda dan model akan mengembalikan argumen terstruktur ketika sesuai. Gunakan parameter tools untuk meneruskan daftar definisi tools. Anda juga dapat menggunakan tool_choice untuk memaksa atau memilih tools secara otomatis. Model mengembalikan respons dengan tool calls, yang dapat Anda kirimkan kembali ke API untuk melanjutkan percakapan. Ini memungkinkan pembuatan agen atau alur kerja otomatis. Definisi tools mengikuti format standar OpenAI. Model tanpa sensor menangani definisi tools secara akurat tanpa menolak untuk menggunakannya untuk kasus penggunaan yang valid. Mode JSON juga tersedia untuk format output yang lebih ketat.

Mode JSON

Untuk aplikasi yang memerlukan output ketat, gunakan mode JSON. Atur response_format ke {"type": "json_object"}. Model akan mencoba mengembalikan objek JSON yang valid. Ini berguna untuk mengurai data, menghasilkan file konfigurasi, atau memasukkan data terstruktur ke sistem lain. Mode JSON berfungsi bersama pemanggilan fungsi. Anda juga dapat mengatur parameter seperti temperature, top_p, stop, seed, presence_penalty, dan frequency_penalty untuk mengontrol kreativitas dan determinisme. Parameter ini standar untuk klien kompatibel OpenAI. Sesuaikan untuk menyeimbangkan konsistensi dan kreativitas berdasarkan kasus penggunaan Anda.

Batas, Error & Konteks

Setiap kunci API dibatasi hingga 300 permintaan per menit dan 8 permintaan paralel. Badan permintaan tidak boleh melebihi 8 MB. Jika kunci tidak valid, Anda menerima error 401. Jika Anda tidak memiliki saldo, Anda menerima error 402. Jika Anda melebihi batas laju, Anda menerima error 429. Kesalahan dan penolakan gratis, sehingga Anda tidak dikenakan biaya untuk permintaan yang gagal. Jendela konteks adalah 100.000 token total. Batas konten keras berlaku: permintaan yang melibatkan konten seksual dengan anak di bawah umur selalu ditolak. API hanya teks. Tidak ada embedding, gambar, atau fine-tuning yang tersedia. Untuk model vendor lain, periksa dokumentasi mereka untuk harga dan batas saat ini. Layanan ini adalah alternatif independen, tidak berafiliasi dengan mereka.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Spesifikasi teknis

Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.

ItemNilai
Formatkompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci
Base URLhttps://api.kimiapi.cc/v1
ID modeluncensored
AutentikasiAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Mode JSONresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Jendela konteks100.000 token (input + output)
Function callingya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool
Streamingya — server-sent events; potongan terakhir berisi penggunaan token
Output maksimalhingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah)
Ukuran permintaanhingga 8 MB
Batas laju300 permintaan per menit per kunci
Header responsX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Konkurensi8 permintaan bersamaan per kunci
Uji coba gratis$0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama
Masa berlakusaldo berbayar tidak kedaluwarsa, tanpa langganan
Penagihansaldo prabayar sesuai pemakaian nyata; error dan penolakan gratis
Isi saldoUSDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500
Bonus+5% mulai $50, +10% mulai $100
Harga$0,25 per 1 juta token input · $1,00 per 1 juta token output
MasukGoogle atau email dan kata sandi
Kuncisatu kunci aktif per akun; kunci baru menggantikan yang lama
Kontenkonten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak

Kode error

Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.

KodeTipeArti
400bad_requestJSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang
401missing_key · invalid_key · key_revokedkunci tidak ada, salah, atau sudah diganti
402no_creditsaldo habis — isi ulang dan lanjut seketika
403content_blockedkonten seksual dengan anak di bawah umur — ditolak, tidak ditagih
404not_foundendpoint tidak dikenal
413request_too_largebody lebih dari 8 MB
429rate_limited · concurrencylebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi
503upstream_busymodel sibuk — coba lagi beberapa detik lagi

Tanya jawab

Apa itu jendela konteks dan batas output?

Jendela konteks adalah 100.000 token untuk prompt dan completion gabungan. Output maksimum per permintaan adalah 32.000 token. Jika Anda tidak mengatur <code>max_tokens</code>, batasnya adalah 2.048 token.

Bagaimana cara mengisi saldo saya?

Isi saldo hanya menggunakan kripto: USDT (TRC20) atau USDC (Base). Jumlah yang diterima adalah dolar utuh mulai dari $10 hingga $500. Anda mendapatkan bonus +5% untuk isi ulang $50 atau lebih, dan bonus +10% untuk $100 atau lebih. Saldo tidak pernah kedaluwarsa.

Apakah ini API Kimi resmi?

Tidak. Ini adalah layanan independen yang menyediakan endpoint kompatibel OpenAI. Kami melayani satu model tanpa sensor. Kami tidak berafiliasi dengan Moonshot AI atau vendor lain. Periksa dokumentasi vendor masing-masing untuk API resmi mereka.

Kunci Anda hanya selangkah lagi dari satu formulir

Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.

Dapatkan kunci API