เริ่มต้นใช้งานสำหรับผู้ใช้ Kimi
ใส่ base URL และคีย์ API ใหม่เพื่อเปลี่ยนเส้นทางคำขอ OpenAI SDK ที่มีอยู่ของคุณไปยัง LLM แบบไม่เซ็นเซอร์ คู่มือนี้แสดงบรรทัดสามบรรทัดที่จำเป็นในการเริ่มแชท สตรีมมิง และใช้เครื่องมือกับเอนด์พอยต์ที่เข้ากันได้ของเรา
ข้อกำหนดเบื้องต้น: คีย์ API
ก่อนส่งคำขอ คุณต้องมีคีย์ API สมัครสมาชิกที่หน้า Get API key โดยใช้ Continue with Google หรืออีเมลและรหัสผ่าน คีย์ของคุณจะปรากฏทันที บัญชีใหม่ได้รับเครดิตทดลองใช้ $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร สำหรับการใช้งานแบบเสียเงิน ให้เติมเงินด้วย USDT (TRC20) หรือ USDC (Base) การเติมเงินมีตั้งแต่ $10 ถึง $500 คุณจะได้รับโบนัส +5% สำหรับการเติมเงิน $50 ขึ้นไป และโบนัส +10% สำหรับ $100 ขึ้นไป เครดิตไม่หมดอายุ และจะถูกคิดเฉพาะการใช้โทเคนจริง ความผิดพลาดและการปฏิเสธไม่เสียค่าใช้จ่าย คุณสามารถถือคีย์ที่ใช้งานอยู่ได้หนึ่งคีย์ต่อบัญชี การสร้างคีย์ใหม่จะแทนที่คีย์เก่า ใช้คีย์นี้ในหัวAuthorization สำหรับคำขอทั้งหมด
การตอบกลับแชทพื้นฐาน
เอนด์พอยต์kimi api รับคำขอ chat-completion มาตรฐานของ OpenAI ตั้งค่า base URL ของไคลเอนต์เป็น https://api.kimiapi.cc/v1 และระบุคีย์ของคุณ เราให้บริการโมเดล uncensored เฉพาะตัวหนึ่งตัวที่ระบุด้วย ID uncensored โมเดลนี้เป็น open-weight model ทำงานบนเซิร์ฟเวอร์ของเรา และไม่ปฏิเสธหัวข้อผู้ใหญ่ที่ถูกต้องตามกฎหมาย เรื่องแต่ง หรือหัวข้อที่ถกเถกัน คุณสามารถส่งพรอมต์และรับข้อความตอบกลับ โมเดลรองรับหน้าต่างบริบท 100,000 โทเคน (พรอมต์ + completion) ผลลัพธ์สูงสุดต่อคำขอคือ 32,000 โทเคน หรือ 2,048 หากไม่ได้ตั้งค่า max_tokens ไม่มีการสร้าง embeddings รูปภาพ หรือเสียง
การตอบกลับแบบสตรีมมิง
ใช้ Server-Sent Events (SSE) สำหรับการสตรีมมิง API จะสตรีมโทเคนเมื่อสร้างเสร็จ ข้อมูลการใช้โทเคนจะรวมอยู่ใน chunk สุดท้ายของสตรีม สิ่งนี้ช่วยให้คุณตรวจสอบต้นทุนแบบเรียลไทม์โดยไม่ต้องรอการตอบกลับทั้งหมด การสตรีมมิงรองรับโดย SDK ที่เข้ากันได้กับ OpenAI มาตรฐานทั้งหมด ตั้งค่าstream=true ในคำขอของคุณ ไคลเอนต์จะได้รับชุดของ delta objects ที่มีข้อความ คุณสามารถรวม delta เหล่านี้เพื่อสร้างการตอบกลับเต็มรูปแบบ สิ่งนี้เหมาะสำหรับอินเทอร์เฟซแชทที่ผู้ใช้คาดหวังการตอบกลับทันที kimi api รับประกันความหน่วงที่คาดการณ์ได้โดยหลีกเลี่ยง overhead ของพร็อกซี
การเรียกใช้ฟังก์ชัน (เครื่องมือ)
API รองรับ function calling หรือที่เรียกว่า tools คุณสามารถกำหนด tools ในคำขอของคุณ และโมเดลจะส่งคืนอาร์กิวเมนต์ที่มีโครงสร้างเมื่อเหมาะสม ใช้พารามิเตอร์tools เพื่อส่งรายการคำจำกัดความของ tools นอกจากนี้คุณยังสามารถใช้ tool_choice เพื่อบังคับหรือเลือก tools อัตโนมัติ โมเดลจะส่งคืนการตอบกลับพร้อม tool calls ซึ่งคุณสามารถส่งกลับไปยัง API เพื่อสนทนาต่อได้ สิ่งนี้ช่วยให้สร้าง agents หรือ workflow อัตโนมัติได้ คำจำกัดความของ tools ปฏิบัติตามรูปแบบมาตรฐานของ OpenAI โมเดลแบบ uncensored จัดการคำจำกัดความของ tools ได้อย่างแม่นยำโดยไม่ปฏิเสธการใช้งานสำหรับ use cases ที่ถูกต้อง นอกจากนี้ยังมีโหมด JSON สำหรับการจัดรูปแบบเอาต์พุตที่เข้มงวดกว่า
โหมด JSON
สำหรับแอปพลิเคชันที่ต้องการเอาต์พุตที่เข้มงวด ให้ใช้โหมด JSON ตั้งค่าresponse_format เป็น {"type": "json_object"} โมเดลจะพยายามส่งคืนวัตถุ JSON ที่ถูกต้อง สิ่งนี้มีประโยชน์สำหรับการแยกวิเคราะห์ข้อมูล สร้างไฟล์กำหนดค่า หรือป้อนข้อมูลที่มีโครงสร้างไปยังระบบอื่น โหมด JSON ทำงานร่วมกับ function calling นอกจากนี้คุณยังสามารถตั้งค่าพารามิเตอร์เช่น temperature, top_p, stop, seed, presence_penalty และ frequency_penalty เพื่อควบคุมความคิดสร้างสรรค์และความแน่นอน พารามิเตอร์เหล่านี้เป็นมาตรฐานสำหรับไคลเอนต์ที่เข้ากันได้กับ OpenAI ปรับค่าเหล่านี้เพื่อปรับสมดุลความสม่ำเสมอและความสร้างสรรค์ตาม use case ของคุณ
ขีดจำกัด ข้อผิดพลาด และบริบท
คีย์ API แต่ละตัวจำกัดที่ 300 คำขอต่อนาทีและ 8 คำขอพร้อมกัน ร่างคำขอต้องไม่เกิน 8 MB หากคีย์ไม่ถูกต้อง คุณจะรับข้อผิดพลาด 401 หากไม่มีเครดิต คุณจะรับข้อผิดพลาด 402 หากเกินขีดจำกัดอัตรา คุณจะรับข้อผิดพลาด 429 ข้อผิดพลาดและการปฏิเสธไม่เสียค่าใช้จ่าย ดังนั้นคุณจะไม่ถูกเรียกเก็บสำหรับคำขอที่ล้มเหลว หน้าต่างบริบทคือ 100,000 โทเคนรวม ขีดจำกัดเนื้อหาแบบแข็งใช้: คำขอที่เกี่ยวข้องกับเนื้อหาทางเพศกับเด็กจะได้รับการปฏิเสธเสมอ API เป็นข้อความเท่านั้น ไม่มีการรองรับ embeddings รูปภาพ หรือ fine-tuning สำหรับโมเดลของผู้ขายรายอื่น โปรดตรวจสอบเอกสารของพวกเขาสำหรับราคาและขีดจำกัดปัจจุบัน บริการนี้เป็นทางเลือกอิสระ ไม่เกี่ยวข้องกับผู้ขายรายอื่น
cURL
curl https://api.kimiapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.kimiapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.kimiapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);สตรีมมิง
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| Base URL | https://api.kimiapi.cc/v1 |
| ID โมเดล | uncensored |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
หน้าต่างบริบทและขีดจำกัดผลลัพธ์คืออะไร?
หน้าต่างบริบทคือ 100,000 โทเคนสำหรับพรอมต์และการตอบกลับรวมกัน ผลลัพธ์สูงสุดต่อคำขอคือ 32,000 โทเคน หากคุณไม่ได้ตั้งค่า <code>max_tokens</code> ขีดจำกัดคือ 2,048 โทเคน
ฉันเติมเครดิตได้อย่างไร?
เติมเงินด้วยคริปโตเท่านั้น: USDT (TRC20) หรือ USDC (Base) จำนวนที่รับได้คือจำนวนเต็มดอลลาร์จาก $10 ถึง $500 คุณจะได้รับโบนัส +5% สำหรับการเติมเงิน $50 ขึ้นไป และโบนัส +10% สำหรับ $100 ขึ้นไป เครดิตไม่หมดอายุ
นี่คือ API Kimi อย่างเป็นทางการหรือไม่?
ไม่ นี่คือบริการอิสระที่ให้บริการเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เราให้บริการโมเดลแบบไม่เซ็นเซอร์เพียงโมเดลเดียว เราไม่เกี่ยวข้องกับ Moonshot AI หรือผู้ขายรายอื่น ตรวจสอบเอกสารของผู้ขายแต่ละรายสำหรับ API อย่างเป็นทางการของพวกเขา
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base URL นั่นคือการตั้งค่าทั้งหมด