VI ▾
Lấy khóa API

Hướng dẫn nhanh cho người dùng Minicpm

Kết nối ứng dụng khách tương thích OpenAI hiện có của bạn với API không kiểm duyệt của chúng tôi trong chưa đầy một phút. Thay đổi base URL của bạn, đặt khóa và bắt đầu tạo văn bản với mô hình "không kiểm duyệt".

Base URL và Xác thực

Để sử dụng API này, bạn cần một khóa API và base URL chính xác. Dịch vụ của chúng tôi tương thích hoàn toàn với các thư viện ứng dụng khách OpenAI tiêu chuẩn. Bạn không cần cài đặt các phần phụ trợ mới hoặc học một SDK mới. Chỉ cần trỏ ứng dụng khách hiện có của bạn vào endpoint của chúng tôi.

Tạo khóa trên trang Lấy khóa API. Bạn có thể đăng nhập bằng Google hoặc sử dụng email và mật khẩu. Khóa được hiển thị ngay lập tức. Hãy lưu trữ nó một cách bảo mật. Mọi yêu cầu đều phải bao gồm khóa này trong tiêu đề Authorization.

Base URL cho tất cả yêu cầu là: https://api.minicpm.cc/v1. URL này xử lý hoàn tất hội thoại, liệt kê mô hình và phản hồi truyền phát. Không có endpoint riêng cho embeddings hay vision. Đây là API chỉ xử lý văn bản.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn tất hội thoại tiêu chuẩn để bắt đầu tạo văn bản. ID mô hình luôn là uncensored. Đây là mô hình ngôn ngữ lớn trọng số mở được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp. Nó không phải là GPT, Claude hay mô hình của nhà cung cấp nào khác.

Đặt trường model thành uncensored. Cung cấp các thông điệp của bạn theo định dạng mảng tiêu chuẩn. API trả về phản hồi văn bản. Bạn có thể kiểm soát độ dài đầu ra bằng max_tokens. Nếu bạn không đặt nó, giá trị max output mặc định là 2.048 token.

Tích hợp SDK Python

Sử dụng thư viện Python OpenAI chính thức để tương tác với API. Bạn chỉ cần cấu hình base URL và khóa API. Phần còn lại của thư viện hoạt động như mong đợi. Điều này bao gồm hỗ trợ streaming, gọi hàm và chế độ JSON.

Cài đặt thư viện với pip install openai. Khởi tạo ứng dụng khách với base URL và khóa của bạn. Gửi các thông điệp đến endpoint hoàn tất trò chuyện. Đối tượng phản hồi chứa văn bản được tạo, mức sử dụng token và lý do kết thúc. Bạn có thể truy cập các trường này trực tiếp trong mã Python của mình.

Tích hợp SDK Node.js

SDK Node.js hoạt động giống hệt phiên bản Python. Cài đặt gói và cấu hình base URL. Ứng dụng khách xử lý xác thực và định dạng yêu cầu một cách tự động. Điều này cho phép bạn tích hợp API vào các dịch vụ backend của mình một cách nhanh chóng.

Chuyển base URL và khóa API vào hàm tạo ứng dụng khách OpenAI. Sử dụng phương thức chat.completions.create. Cấu trúc phản hồi phù hợp với tiêu chuẩn OpenAI. Bạn có thể xử lý lỗi, kiểm tra mức sử dụng token và xử lý nội dung. Cách tiếp cận này đảm bảo tương thích với các cơ sở mã hiện có đã sử dụng OpenAI.

Phản hồi Streaming

Bật streaming bằng cách đặt stream: true trong yêu cầu của bạn. API trả về một chuỗi các sự kiện gửi qua máy chủ (SSE). Mỗi sự kiện chứa một chunk của phản hồi. Điều này cho phép bạn hiển thị văn bản cho người dùng khi nó được tạo.

Chunk cuối cùng bao gồm thống kê sử dụng token. Điều này rất hữu ích để theo dõi chi phí. Streaming giảm độ trễ cảm nhận đối với người dùng. Nó được khuyến nghị cho các giao diện trò chuyện. Bạn có thể phân tích các sự kiện trong mã ứng dụng khách của mình để xây dựng phản hồi cuối cùng hoặc hiển thị token theo thời gian thực.

Giới hạn, Lỗi và Ngữ cảnh

Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token. Điều này bao gồm cả prompt và kết quả hoàn tất. Số token tối đa cho mỗi yêu cầu là 32.000. Bạn có thể điều chỉnh tham số max_tokens để kiểm soát điều này.

Giới hạn tốc độ được đặt ở mức 300 yêu cầu mỗi phút trên mỗi khóa. Bạn có thể có tối đa 8 yêu cầu đồng thời. Thân yêu cầu phải dưới 8 MB. Nếu khóa không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu bạn không có tín dụng, bạn sẽ nhận được lỗi 402. Nếu vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Lỗi và từ chối không tiêu tốn tín dụng.

cURL

curl https://api.minicpm.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.minicpm.cc/v1
ID mô hìnhuncensored
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thưởng+5% từ $50, +10% từ $100
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt đầu vào và kết quả đầu ra. Số token tối đa cho mỗi yêu cầu là 32.000.

Tôi xử lý lỗi như thế nào?

Lỗi 401 cho biết khóa API không hợp lệ. Lỗi 402 cho biết tín dụng trả trước của bạn đã hết. Lỗi 429 có nghĩa là bạn đã vượt quá giới hạn tốc độ 300 yêu cầu mỗi phút. Lỗi không tiêu tốn tín dụng của bạn.

Tôi có thể sử dụng streaming không?

Có. Đặt <code>stream: true</code> trong yêu cầu của bạn. API trả về các sự kiện gửi qua máy chủ (SSE). Chunk cuối cùng chứa thống kê sử dụng token.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API