เริ่มต้นใช้งานสำหรับผู้ใช้ Minicpm
เชื่อมต่อไคลเอนต์ที่เข้ากันได้กับ OpenAI ที่มีอยู่ของคุณกับ API แบบไม่เซ็นเซอร์ของเราภายในหนึ่งนาที เปลี่ยน Base URL ตั้งค่าคีย์ของคุณ และเริ่มสร้างข้อความด้วยโมเดล "uncensored"
Base URL และการตรวจสอบสิทธิ์
เพื่อใช้ API นี้ คุณต้องมีคีย์ API และ Base URL ที่ถูกต้อง บริการของเราเข้ากันได้กับไลบรารีไคลเอนต์มาตรฐานของ OpenAI คุณไม่จำเป็นต้องติดตั้งส่วนขยายใหม่หรือเรียนรู้ SDK ใหม่ เพียงชี้ไคลเอนต์ที่มีอยู่ของคุณไปยังเอนด์พอยต์ของเรา
สร้างคีย์บนหน้า รับคีย์ API คุณสามารถเข้าสู่ระบบด้วย Google หรือใช้อีเมลและรหัสผ่าน คีย์จะแสดงทันที เก็บไว้อย่างปลอดภัย ทุกคำขอต้องรวมคีย์นี้ในหัว Authorization
Base URL สำหรับคำขอทั้งหมดคือ: https://api.minicpm.cc/v1 URL นี้จัดการการสร้างข้อความแบบแชท การแสดงรายการโมเดล และการตอบสนองแบบสตรีมมิง ไม่มีเอนด์พอยต์แยกสำหรับ embeddings หรือวิชัน นี่คือ API สำหรับข้อความเท่านั้น
คำขอแรก
ส่งคำขอสร้างข้อความแบบแชทมาตรฐานเพื่อเริ่มสร้างข้อความ รหัสโมเดลคือ uncensored เสมอ โมเดลนี้เป็นโมเดลภาษาขนาดใหญ่แบบเปิดน้ำหนักที่ปรับแต่งเพื่อตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ไม่ใช่ GPT, Claude หรือโมเดลของผู้จัดจำหน่ายรายอื่น
ตั้งค่าฟิลด์ model เป็น uncensored จัดเตรียมข้อความของคุณในรูปแบบอาร์เรย์มาตรฐาน API จะส่งการตอบสนองเป็นข้อความ คุณสามารถควบคุมความยาวเอาต์พุตด้วย max_tokens หากไม่ได้ตั้งค่า ค่าสูงสุดเริ่มต้นของเอาต์พุตคือ 2,048 โทเคน
การผสานรวม Python SDK
ใช้ไลบรารี Python ทางการของ OpenAI เพื่อโต้ตอบกับ API คุณเพียงแค่ต้องกำหนดค่า Base URL และคีย์ API ส่วนที่เหลือของไลบรารีทำงานตามที่คาดไว้ รวมถึงการสนับสนุนสตรีมมิง การเรียกใช้ฟังก์ชัน และโหมด JSON
ติดตั้งไลบรารีด้วย pip install openai เริ่มต้นไคลเอนต์ด้วย Base URL และคีย์ของคุณ ส่งข้อความไปยังเอนด์พอยต์สร้างข้อความแบบแชท วัตถุการตอบสนองประกอบด้วยข้อความที่สร้าง สถิติการใช้งานโทเคน และเหตุผลการสิ้นสุด คุณสามารถเข้าถึงฟิลด์เหล่านี้โดยตรงในโค้ด Python ของคุณ
การผสานรวม Node SDK
Node.js SDK ทำงานเหมือนกับเวอร์ชัน Python ติดตั้งแพ็กเกจและกำหนดค่า Base URL ไคลเอนต์จัดการการตรวจสอบสิทธิ์และการจัดรูปแบบคำขอโดยอัตโนมัติ สิ่งนี้ช่วยให้คุณผสานรวม API เข้ากับบริการแบ็กเอนด์ของคุณได้อย่างรวดเร็ว
ส่ง Base URL และคีย์ API ไปยังคอนสตรัคเตอร์ไคลเอนต์ OpenAI ใช้วิธี chat.completions.create โครงสร้างการตอบสนองตรงกับมาตรฐานของ OpenAI คุณสามารถจัดการข้อผิดพลาด ตรวจสอบการใช้งานโทเคน และประมวลผลเนื้อหา วิธีการนี้รับประกันความเข้ากันได้กับโค้ดเบสที่มีอยู่แล้วที่ใช้ OpenAI
การตอบสนองแบบสตรีมมิง
เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true ในคำขอของคุณ API จะส่งลำดับของ Server-Sent Events (SSE) แต่ละเหตุการณ์ประกอบด้วยชิ้นส่วนของการตอบสนอง สิ่งนี้ช่วยให้คุณแสดงข้อความให้ผู้ใช้เห็นเมื่อข้อความถูกสร้าง
ชิ้นสุดท้ายรวมถึงสถิติการใช้งานโทเคน สิ่งนี้มีประโยชน์สำหรับการติดตามต้นทุน การสตรีมมิงลดความล่าช้าที่ผู้ใช้รู้สึก แนะนำสำหรับอินเทอร์เฟซแชท คุณสามารถแยกวิเคราะห์เหตุการณ์ในโค้ดไคลเอนต์ของคุณเพื่อสร้างการตอบสนองสุดท้ายหรือแสดงโทเคนแบบเรียลไทม์
ขีดจำกัด ข้อผิดพลาด และบริบท
โมเดลรองรับหน้าต่างบริบท 100,000 โทเคน ซึ่งรวมถึงพรอมต์และการสร้างข้อความ เอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน คุณสามารถปรับพารามิเตอร์ max_tokens เพื่อควบคุมสิ่งนี้
ขีดจำกัดอัตราถูกตั้งค่าไว้ที่ 300 คำขอต่อนาทีต่อคีย์ คุณสามารถมีคำขอพร้อมกัน 8 คำขอ ร่างคำขอต้องไม่เกิน 8 MB หากคีย์ไม่ถูกต้อง คุณจะได้รับข้อผิดพลาด 401 หากไม่มีเครดิต คุณจะได้รับข้อผิดพลาด 402 หากคุณเกินขีดจำกัดอัตรา คุณจะได้รับข้อผิดพลาด 429 ข้อผิดพลาดและการปฏิเสธไม่ใช้เครดิต
cURL
curl https://api.minicpm.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);สตรีมมิง
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| Base URL | https://api.minicpm.cc/v1 |
| ID โมเดล | uncensored |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
ขนาดหน้าต่างบริบทคือเท่าใด?
หน้าต่างบริบทมีขนาด 100,000 โทเคน ซึ่งรวมถึงพรอมต์อินพุตและการสร้างเอาต์พุต โดยเอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน
ฉันจัดการข้อผิดพลาดอย่างไร?
ข้อผิดพลาด 401 หมายถึงคีย์ API ไม่ถูกต้อง ข้อผิดพลาด 402 หมายถึงเครดิตแบบเติมเงินล่วงหน้าของคุณหมดแล้ว ข้อผิดพลาด 429 หมายถึงคุณเกินขีดจำกัดอัตรา 300 คำขอต่อนาที ข้อผิดพลาดไม่ใช้เครดิตของคุณ
ฉันใช้สตรีมมิงได้หรือไม่?
ได้ ตั้งค่า <code>stream: true</code> ในคำขอของคุณ API จะส่ง Server-Sent Events (SSE) ชิ้นสุดท้ายประกอบด้วยสถิติการใช้งานโทเคน
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน Base URL นั่นคือการตั้งค่าทั้งหมด