Minicpm 用戶快速上手
在不到一分鐘內將您現有的 OpenAI 相容用戶端連線至我們的無審查 API。取代您的 Base URL、設定金鑰,並開始使用「無審查」模型生成文字。
Base URL 與驗證
要使用此 API,您需要 API 金鑰與正確的 Base URL。我們的服務完全相容於標準 OpenAI 用戶端程式庫。您無需安裝新的相依套件或學習新的 SDK。只需將您現有的用戶端指向我們的端點即可。
在取得 API 金鑰頁面產生金鑰。您可以使用 Google 登入,或使用電子郵件與密碼。金鑰會立即顯示。請安全儲存。每筆請求都必須在Authorization標頭中包含此金鑰。
所有請求的 Base URL 為:https://api.minicpm.cc/v1。此 URL 處理聊天補全、模型列出與串流回應。沒有用於嵌入或視覺的獨立端點。這是一個僅限文字的 API。
首次請求
發送標準的聊天補全請求以開始生成文字。模型 ID 始終為uncensored。此模型是一個開放權重大型語言模型,針對合法成人用途進行微調,可無內容拒絕地回答。它不是 GPT、Claude 或其他廠商的模型。
將model欄位設定為uncensored。以標準陣列格式提供您的訊息。API 會回傳文字回應。您可以使用max_tokens控制輸出長度。若未設定,預設最大輸出為 2,048 token。
Python SDK 整合
使用官方 OpenAI Python 函式庫與 API 互動。你只需設定 Base URL 與 API 金鑰即可。函式庫其餘功能皆如預期運作。這包括支援串流輸出、函式呼叫與 JSON 模式。
使用 pip install openai 安裝函式庫。以你的 Base URL 和金鑰初始化客戶端。向聊天完成端點傳送訊息。回應物件包含生成的文字、token 用量與結束原因。你可以在 Python 程式碼中直接存取這些欄位。
Node SDK 整合
Node.js SDK 的運作方式與 Python 版本相同。安裝套件並設定 Base URL。用戶端會自動處理驗證與請求格式化。這使您能快速將 API 整合至後端服務。
將 Base URL 與 API 金鑰傳遞給 OpenAI 用戶端建構子。使用chat.completions.create方法。回應結構符合 OpenAI 標準。您可以處理錯誤、檢查 token 使用情況並處理內容。此方法確保與已使用 OpenAI 的現有程式碼庫相容。
串流回應
在請求中設定stream: true以啟用串流。API 會回傳一系列 Server-Sent Events (SSE)。每個事件包含回應的區塊。這允許您在生成文字時即時顯示給使用者。
最後一個區塊包含 token 使用統計。這有助於追蹤成本。串流可降低使用者的感知延遲。建議用於聊天介面。您可以在用戶端程式碼中解析事件,以建構最終回應或即時顯示 token。
限制、錯誤與上下文
此模型支援 100,000 token 的上下文視窗。這包含提示詞與補全。每筆請求的最大輸出為 32,000 token。您可以調整max_tokens參數來控制此限制。
速率限制設為每分鐘每支金鑰 300 次請求。你可擁有 8 個並行請求。請求主體必須在 8 MB 以下。若金鑰無效,你將收到 401 錯誤。若你沒有額度,你將收到 402 錯誤。若超過速率限制,你將收到 429 錯誤。錯誤與拒絕不會消耗額度。
cURL
curl https://api.minicpm.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);串流輸出
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)API 技術參數
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| Base URL | https://api.minicpm.cc/v1 |
| 模型 ID | uncensored |
| 驗證 | Authorization: Bearer YOUR_KEY |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 請求大小 | 每次請求不超過 8 MB |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 登入 | Google 或電子郵件 + 密碼 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
上下文視窗的大小是多少?
上下文視窗為 100,000 token,包含輸入提示詞與輸出補全。每筆請求的最大輸出為 32,000 token。
我該如何處理錯誤?
401 錯誤表示 API 金鑰無效。402 錯誤表示你的預付額度已耗盡。429 錯誤表示你已超過每分鐘 300 次請求的速率限制。錯誤不會消耗你的額度。
我可以使用串流輸出嗎?
可以。在請求中設定 <code>stream: true</code>。API 會回傳 Server-Sent Events (SSE)。最後一個區塊包含 token 使用統計。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、變更 Base URL。這就是整個設定。