VI ▾
Lấy khóa API

Hướng dẫn nhanh cho người dùng Kimi

Đặt lại URL cơ sở và khóa API mới để định tuyến các lệnh gọi SDK OpenAI hiện có của bạn sang LLM không kiểm duyệt. Hướng dẫn này cho thấy chính xác ba dòng cần thiết để bắt đầu trò chuyện, truyền phát và sử dụng công cụ với endpoint tương thích của chúng tôi.

Yêu cầu: Khóa API

Trước khi gửi yêu cầu, bạn cần một khóa API. Đăng ký trên trang Lấy khóa API bằng cách Tiếp tục với Google hoặc email và mật khẩu. Khóa của bạn xuất hiện ngay lập tức. Tài khoản mới nhận được $0,50 tín dụng dùng thử hợp lệ trong 7 ngày; không cần thẻ. Để sử dụng trả phí, hãy nạp tiền bằng USDT (TRC20) hoặc USDC (Base). Khoản nạp từ $10 đến $500. Bạn nhận được bonus +5% cho khoản nạp từ $50 trở lên, và bonus +10% cho $100 trở lên. Tín dụng không bao giờ hết hạn và chỉ bị tính phí cho việc sử dụng token thực tế. Lỗi và từ chối đều miễn phí. Bạn có thể giữ một khóa hoạt động mỗi tài khoản; tạo khóa mới sẽ thay thế khóa cũ. Sử dụng khóa này trong tiêu đề Authorization cho tất cả các yêu cầu.

Hoàn thành trò chuyện cơ bản

Endpoint kimi api chấp nhận các yêu cầu hoàn thành trò chuyện OpenAI tiêu chuẩn. Đặt URL cơ sở của máy khách của bạn thành https://api.kimiapi.cc/v1 và cung cấp khóa của bạn. Chúng tôi phục vụ một mô hình không kiểm duyệt chuyên dụng duy nhất được xác định bằng ID uncensored. Mô hình này là mô hình trọng số mở, chạy trên máy chủ của chúng tôi và không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Nó không phải là GPT, Claude, Gemini hoặc bất kỳ mô hình của nhà cung cấp nào khác. Bạn có thể gửi prompt và nhận phản hồi văn bản. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token (prompt + hoàn thành). Đầu ra tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu bạn không đặt max_tokens. Không tạo embedding, hình ảnh hoặc âm thanh.

Phản hồi truyền phát

Sử dụng Sự kiện gửi qua máy chủ (SSE) để truyền phát. API truyền phát token khi chúng được tạo. Thông tin sử dụng token được bao gồm trong chunk cuối cùng của luồng. Điều này cho phép bạn theo dõi chi phí theo thời gian thực mà không cần chờ phản hồi đầy đủ. Truyền phát được hỗ trợ bởi tất cả các SDK tương thích OpenAI tiêu chuẩn. Đặt stream=true trong yêu cầu của bạn. Client sẽ nhận được một chuỗi các đối tượng delta chứa văn bản. Bạn có thể nối các delta này để tái tạo phản hồi đầy đủ. Điều này lý tưởng cho các giao diện trò chuyện nơi người dùng mong đợi phản hồi ngay lập tức. kimi api đảm bảo độ trễ dự đoán được bằng cách tránh chi phí trung gian.

Gọi hàm (Công cụ)

API hỗ trợ gọi hàm, còn được gọi là công cụ. Bạn có thể xác định công cụ trong yêu cầu của mình và mô hình sẽ trả về các đối số có cấu trúc khi thích hợp. Sử dụng tham số tools để truyền danh sách các định nghĩa công cụ. Bạn cũng có thể sử dụng tool_choice để bắt buộc hoặc tự động chọn công cụ. Mô hình trả về phản hồi với các lệnh gọi công cụ, mà bạn có thể truyền lại cho API để tiếp tục cuộc trò chuyện. Điều này cho phép xây dựng các tác nhân hoặc quy trình làm việc tự động. Các định nghĩa công cụ tuân theo định dạng OpenAI tiêu chuẩn. Mô hình không kiểm duyệt xử lý chính xác các định nghĩa công cụ mà không từ chối sử dụng chúng cho các trường hợp sử dụng hợp lệ. Chế độ JSON cũng có sẵn để định dạng đầu ra nghiêm ngặt hơn.

Chế độ JSON

Đối với các ứng dụng yêu cầu đầu ra nghiêm ngặt, hãy sử dụng chế độ JSON. Đặt response_format thành {"type": "json_object"}. Mô hình sẽ cố gắng trả về một đối tượng JSON hợp lệ. Điều này hữu ích để phân tích dữ liệu, tạo tệp cấu hình hoặc cung cấp dữ liệu có cấu trúc cho các hệ thống khác. Chế độ JSON hoạt động cùng với gọi hàm. Bạn cũng có thể đặt các tham số như temperature, top_p, stop, seed, presence_penalty và frequency_penalty để kiểm soát sự sáng tạo và tính xác định. Các tham số này là tiêu chuẩn cho các máy khách tương thích OpenAI. Điều chỉnh chúng để cân bằng giữa tính nhất quán và sáng tạo dựa trên trường hợp sử dụng của bạn.

Giới hạn, Lỗi & Ngữ cảnh

Mỗi khóa API bị giới hạn ở 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Nếu khóa không hợp lệ, bạn nhận được lỗi 401. Nếu bạn không có tín dụng, bạn nhận được lỗi 402. Nếu bạn vượt quá giới hạn tốc độ, bạn nhận được lỗi 429. Lỗi và từ chối đều miễn phí, vì vậy bạn không phải trả tiền cho các yêu cầu thất bại. Cửa sổ ngữ cảnh là 100.000 token tổng cộng. Có một giới hạn nội dung cứng: các yêu cầu liên quan đến nội dung tình dục với người chưa thành niên luôn bị từ chối. API chỉ hỗ trợ văn bản. Không có embedding, hình ảnh hoặc tinh chỉnh. Đối với các mô hình của nhà cung cấp khác, hãy kiểm tra tài liệu của họ để biết giá và giới hạn hiện tại. Dịch vụ này là một giải pháp thay thế độc lập, không liên kết với họ.

cURL

curl https://api.kimiapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Truyền phát

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.kimiapi.cc/v1
ID mô hìnhuncensored
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Cửa sổ ngữ cảnh và giới hạn đầu ra là gì?

Cửa sổ ngữ cảnh là 100.000 token cho prompt và kết hợp hoàn thành. Đầu ra tối đa mỗi yêu cầu là 32.000 token. Nếu bạn không đặt <code>max_tokens</code>, giới hạn là 2.048 token.

Tôi nạp tiền tín dụng như thế nào?

Nạp tiền chỉ bằng tiền điện tử: USDT (TRC20) hoặc USDC (Base). Số tiền chấp nhận là số nguyên từ $10 đến $500. Bạn nhận được bonus +5% cho khoản nạp từ $50 trở lên, và bonus +10% cho $100 trở lên. Tín dụng không bao giờ hết hạn.

Đây có phải là API Kimi chính thức không?

Không. Đây là dịch vụ độc lập cung cấp endpoint tương thích OpenAI. Chúng tôi phục vụ một mô hình không kiểm duyệt duy nhất. Chúng tôi không liên kết với Moonshot AI hoặc bất kỳ nhà cung cấp nào khác. Hãy kiểm tra tài liệu của nhà cung cấp tương ứng để biết API chính thức của họ.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API