Hướng dẫn nhanh cho người dùng Kimi
Đặt lại URL cơ sở và khóa API mới để định tuyến các lệnh gọi SDK OpenAI hiện có của bạn sang LLM không kiểm duyệt. Hướng dẫn này cho thấy chính xác ba dòng cần thiết để bắt đầu trò chuyện, truyền phát và sử dụng công cụ với endpoint tương thích của chúng tôi.
Yêu cầu: Khóa API
Trước khi gửi yêu cầu, bạn cần một khóa API. Đăng ký trên trang Lấy khóa API bằng cách Tiếp tục với Google hoặc email và mật khẩu. Khóa của bạn xuất hiện ngay lập tức. Tài khoản mới nhận được $0,50 tín dụng dùng thử hợp lệ trong 7 ngày; không cần thẻ. Để sử dụng trả phí, hãy nạp tiền bằng USDT (TRC20) hoặc USDC (Base). Khoản nạp từ $10 đến $500. Bạn nhận được bonus +5% cho khoản nạp từ $50 trở lên, và bonus +10% cho $100 trở lên. Tín dụng không bao giờ hết hạn và chỉ bị tính phí cho việc sử dụng token thực tế. Lỗi và từ chối đều miễn phí. Bạn có thể giữ một khóa hoạt động mỗi tài khoản; tạo khóa mới sẽ thay thế khóa cũ. Sử dụng khóa này trong tiêu đềAuthorization cho tất cả các yêu cầu.
Hoàn thành trò chuyện cơ bản
Endpointkimi api chấp nhận các yêu cầu hoàn thành trò chuyện OpenAI tiêu chuẩn. Đặt URL cơ sở của máy khách của bạn thành https://api.kimiapi.cc/v1 và cung cấp khóa của bạn. Chúng tôi phục vụ một mô hình không kiểm duyệt chuyên dụng duy nhất được xác định bằng ID uncensored. Mô hình này là mô hình trọng số mở, chạy trên máy chủ của chúng tôi và không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Nó không phải là GPT, Claude, Gemini hoặc bất kỳ mô hình của nhà cung cấp nào khác. Bạn có thể gửi prompt và nhận phản hồi văn bản. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token (prompt + hoàn thành). Đầu ra tối đa mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu bạn không đặt max_tokens. Không tạo embedding, hình ảnh hoặc âm thanh.
Phản hồi truyền phát
Sử dụng Sự kiện gửi qua máy chủ (SSE) để truyền phát. API truyền phát token khi chúng được tạo. Thông tin sử dụng token được bao gồm trong chunk cuối cùng của luồng. Điều này cho phép bạn theo dõi chi phí theo thời gian thực mà không cần chờ phản hồi đầy đủ. Truyền phát được hỗ trợ bởi tất cả các SDK tương thích OpenAI tiêu chuẩn. Đặtstream=true trong yêu cầu của bạn. Client sẽ nhận được một chuỗi các đối tượng delta chứa văn bản. Bạn có thể nối các delta này để tái tạo phản hồi đầy đủ. Điều này lý tưởng cho các giao diện trò chuyện nơi người dùng mong đợi phản hồi ngay lập tức. kimi api đảm bảo độ trễ dự đoán được bằng cách tránh chi phí trung gian.
Gọi hàm (Công cụ)
API hỗ trợ gọi hàm, còn được gọi là công cụ. Bạn có thể xác định công cụ trong yêu cầu của mình và mô hình sẽ trả về các đối số có cấu trúc khi thích hợp. Sử dụng tham sốtools để truyền danh sách các định nghĩa công cụ. Bạn cũng có thể sử dụng tool_choice để bắt buộc hoặc tự động chọn công cụ. Mô hình trả về phản hồi với các lệnh gọi công cụ, mà bạn có thể truyền lại cho API để tiếp tục cuộc trò chuyện. Điều này cho phép xây dựng các tác nhân hoặc quy trình làm việc tự động. Các định nghĩa công cụ tuân theo định dạng OpenAI tiêu chuẩn. Mô hình không kiểm duyệt xử lý chính xác các định nghĩa công cụ mà không từ chối sử dụng chúng cho các trường hợp sử dụng hợp lệ. Chế độ JSON cũng có sẵn để định dạng đầu ra nghiêm ngặt hơn.
Chế độ JSON
Đối với các ứng dụng yêu cầu đầu ra nghiêm ngặt, hãy sử dụng chế độ JSON. Đặtresponse_format thành {"type": "json_object"}. Mô hình sẽ cố gắng trả về một đối tượng JSON hợp lệ. Điều này hữu ích để phân tích dữ liệu, tạo tệp cấu hình hoặc cung cấp dữ liệu có cấu trúc cho các hệ thống khác. Chế độ JSON hoạt động cùng với gọi hàm. Bạn cũng có thể đặt các tham số như temperature, top_p, stop, seed, presence_penalty và frequency_penalty để kiểm soát sự sáng tạo và tính xác định. Các tham số này là tiêu chuẩn cho các máy khách tương thích OpenAI. Điều chỉnh chúng để cân bằng giữa tính nhất quán và sáng tạo dựa trên trường hợp sử dụng của bạn.
Giới hạn, Lỗi & Ngữ cảnh
Mỗi khóa API bị giới hạn ở 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Nếu khóa không hợp lệ, bạn nhận được lỗi 401. Nếu bạn không có tín dụng, bạn nhận được lỗi 402. Nếu bạn vượt quá giới hạn tốc độ, bạn nhận được lỗi 429. Lỗi và từ chối đều miễn phí, vì vậy bạn không phải trả tiền cho các yêu cầu thất bại. Cửa sổ ngữ cảnh là 100.000 token tổng cộng. Có một giới hạn nội dung cứng: các yêu cầu liên quan đến nội dung tình dục với người chưa thành niên luôn bị từ chối. API chỉ hỗ trợ văn bản. Không có embedding, hình ảnh hoặc tinh chỉnh. Đối với các mô hình của nhà cung cấp khác, hãy kiểm tra tài liệu của họ để biết giá và giới hạn hiện tại. Dịch vụ này là một giải pháp thay thế độc lập, không liên kết với họ.
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Truyền phát
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Base URL | https://api.kimiapi.cc/v1 |
| ID mô hình | uncensored |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Kích thước yêu cầu | tối đa 8 MB |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Cửa sổ ngữ cảnh và giới hạn đầu ra là gì?
Cửa sổ ngữ cảnh là 100.000 token cho prompt và kết hợp hoàn thành. Đầu ra tối đa mỗi yêu cầu là 32.000 token. Nếu bạn không đặt <code>max_tokens</code>, giới hạn là 2.048 token.
Tôi nạp tiền tín dụng như thế nào?
Nạp tiền chỉ bằng tiền điện tử: USDT (TRC20) hoặc USDC (Base). Số tiền chấp nhận là số nguyên từ $10 đến $500. Bạn nhận được bonus +5% cho khoản nạp từ $50 trở lên, và bonus +10% cho $100 trở lên. Tín dụng không bao giờ hết hạn.
Đây có phải là API Kimi chính thức không?
Không. Đây là dịch vụ độc lập cung cấp endpoint tương thích OpenAI. Chúng tôi phục vụ một mô hình không kiểm duyệt duy nhất. Chúng tôi không liên kết với Moonshot AI hoặc bất kỳ nhà cung cấp nào khác. Hãy kiểm tra tài liệu của nhà cung cấp tương ứng để biết API chính thức của họ.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.