JA ▾
API キーを取得

Kimiユーザー向けクイックスタート

既存のOpenAI SDK呼び出しを無検閲LLMにルーティングするために、新しいベースURLとAPIキーを設定するだけです。このガイドでは、チャット、ストリーミング、ツール使用を開始するために必要な3行のコードを示します。

前提条件:APIキー

リクエストを送信する前にAPIキーが必要です。APIキーを取得ページでGoogleで続行またはメールとパスワードを使用してサインアップしてください。キーは即座に表示されます。新規アカウントには7日間有効な$0.50の無料トライアルクレジットが付与されます。カードは不要です。有料利用にはUSDT (TRC20)またはUSDC (Base)でチャージしてください。チャージ額は10ドルから500ドルです。50ドル以上のチャージで+5%ボーナス、100ドル以上で+10%ボーナスが付与されます。クレジットは期限切れせず、実際のトークン使用量のみ課金されます。エラーや拒否は無料です。1アカウントにつきアクティブなキーは1つまで保持でき、新しいキーを生成すると古いキーが置き換えられます。すべてのリクエストでこのキーをAuthorizationヘッダーに使用してください。

基本的なチャット完了

kimi api エンドポイントは標準的なOpenAIチャット完了リクエストを受け付けます。クライアントのベースURLをhttps://api.kimiapi.cc/v1に設定し、APIキーを提供してください。私たちは、IDuncensoredで識別される単一の専用無検閲モデルを提供しています。このモデルはオープンウェイトで、当社のサーバーで動作し、法的な大人向け、フィクション、または論争的なトピックを拒否しません。GPT、Claude、Gemini、またはその他のベンダーのモデルではありません。プロンプトを送信し、テキスト応答を受け取ることができます。このモデルは100,000トークンのコンテキストウィンドウ(プロンプト+補完)をサポートします。1つのリクエストあたりの最大出力は32,000トークンです。max_tokensを設定しない場合は2,048トークンです。埋め込み、画像、音声は生成されません。

ストリーミングレスポンス

ストリーミングにはServer-Sent Events(SSE)を使用します。APIはトークンを生成すると同時にストリーミングします。トークン使用量はストリームの最終チャンクに含まれます。これにより、完全な応答を待たずにリアルタイムでコストを監視できます。ストリーミングは、すべての標準的なOpenAI互換SDKでサポートされています。リクエストでstream=trueを設定してください。クライアントはテキストを含む一連のdeltaオブジェクトを受信します。これらのdeltaを連結することで、完全な応答を復元できます。これは、ユーザーが即時フィードバックを期待するチャットインターフェースに最適です。kimi apiはプロキシオーバーヘッドを回避することで、予測可能なレイテンシを保証します。

関数呼び出し(ツール)

APIは関数呼び出し(ツールとも呼ばれる)をサポートしています。リクエストでツールを定義し、モデルは適切な場合に構造化された引数を返します。toolsパラメータを使用してツール定義のリストを渡します。tool_choiceを使用してツールを強制または自動選択することもできます。モデルはツール呼び出しを含む応答を返し、会話続行のためにAPIに渡すことができます。これにより、エージェントや自動化されたワークフローを構築できます。ツール定義は標準的なOpenAI形式に従います。無検閲モデルは、有効なユースケースに対してツール使用を拒否することなく、正確にツール定義を処理します。より厳格な出力フォーマットのためにJSONモードも利用可能です。

JSONモード

厳格な出力が必要なアプリケーションにはJSONモードを使用してください。response_formatを{"type": "json_object"}に設定してください。モデルは有効なJSONオブジェクトを返そうとします。これはデータの解析、設定ファイルの生成、または他のシステムへの構造化データの供給に役立ちます。JSONモードは関数呼び出しと同時に使用できます。temperature、top_p、stop、seed、presence_penalty、frequency_penaltyなどのパラメータを設定して、創造性と決定論を制御することもできます。これらのパラメータはOpenAI互換クライアントにとって標準的です。ユースケースに基づいて一貫性と創造性のバランスを取るために調整してください。

制限、エラー、コンテキスト

各APIキーは1分あたり300リクエスト、8つの同時リクエストに制限されます。リクエストボディは8 MBを超えてはいけません。キーが無効な場合、401エラーが発生します。クレジットがない場合、402エラーが発生します。レート制限を超えた場合、429エラーが発生します。エラーと拒否は無料なので、失敗したリクエストには課金されません。コンテキストウィンドウは合計100,000トークンです。ハードなコンテンツ制限があり、未成年者との性的コンテンツを含むリクエストは常に拒否されます。APIはテキストのみです。埋め込み、画像、ファインチューニングは利用できません。他のベンダーのモデルについては、現在の価格と制限については各ベンダーのドキュメントをご確認ください。このサービスは独立した代替品であり、それらとは提携していません。

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

ストリーミング

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

技術仕様

購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。

項目内容
形式OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作
Base URLhttps://api.kimiapi.cc/v1
モデル IDuncensored
認証Authorization: Bearer YOUR_KEY
エンドポイントPOST /v1/chat/completions · GET /v1/models
JSON モードresponse_format: {"type": "json_object"}
パラメータtemperature、top_p、stop、seed、presence_penalty、frequency_penalty
コンテキスト長100,000 トークン(入力+出力)
関数呼び出し対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送
ストリーミング対応 — SSE、最後のチャンクにトークン使用量
最大出力100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし)
リクエストサイズ最大 8 MB
レート制限キーごとに毎分 300 リクエスト
レスポンスヘッダーX-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency
同時実行キーごとに同時 8 リクエストまで
無料トライアル$0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大
有効期限購入クレジットは失効なし、サブスクなし
課金前払いクレジットから実使用量で課金。エラーと拒否は無料
チャージUSDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額
ボーナス$50 以上で +5%、$100 以上で +10%
料金入力 100 万トークン $0.25 · 出力 100 万トークン $1.00
ログインGoogle またはメール+パスワード
キーアカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効
コンテンツ成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否

エラーコード

エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。

コードタイプ意味
400bad_requestJSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過
401missing_key · invalid_key · key_revokedキーなし・誤り・新しいキーに置換済み
402no_credit残高ゼロ — チャージすれば即再開
403content_blocked未成年者を含む性的コンテンツ — 拒否、課金なし
404not_found不明なエンドポイント
413request_too_large本文が 8 MB 超
429rate_limited · concurrency毎分 300 回または同時 8 件を超過 — 待って再試行
503upstream_busyモデル混雑 — 数秒後に再試行

質問と回答

コンテキストウィンドウと出力制限は?

プロンプトと補完を合わせたコンテキストウィンドウは100,000トークンです。リクエストごとの最大出力は32,000トークンです。<code>max_tokens</code>を設定しない場合、制限は2,048トークンです。

クレジットをチャージするには?

暗号通貨のみでチャージ:USDT (TRC20) または USDC (Base)。受け付ける金額は10ドルから500ドルまでの整数ドルです。50ドル以上のチャージで+5%のボーナス、100ドル以上のチャージで+10%のボーナスが付与されます。クレジットには期限切れになりません。

これは公式のKimi APIですか?

いいえ。これはOpenAI互換のエンドポイントを提供する独立したサービスです。当社は単一の無検閲モデルを提供しています。Moonshot AI または他のベンダーとは提携していません。公式APIについては各ベンダーのドキュメントをご確認ください。

キーはフォーム 1 つで手に入ります

アカウントを作成し、キーをコピーし、ベースURLを変更するだけです。セットアップはこれだけです。

API キーを取得