MiniCmp 用户快速入门
在一分钟内将现有的 OpenAI 兼容客户端连接到我们的无审查 API。替换基础 URL,设置密钥,并开始使用“无审查”模型生成文本。
基础 URL 和认证
要使用此 API,您需要 API 密钥和正确的基础 URL。我们的服务完全兼容标准的 OpenAI 客户端库。您无需安装新的依赖项或学习新的 SDK。只需将现有客户端指向我们的接口即可。
在获取 API 密钥页面生成密钥。你可以使用 Google 登录,或使用电子邮件和密码登录。密钥会立即显示。请安全保存。每个请求都必须在Authorization头中包含此密钥。
所有请求的基础 URL 为:https://api.minicpm.cc/v1。此 URL 处理聊天补全、模型列表和流式响应。嵌入或视觉功能没有单独的接口。这是一个纯文本 API。
首次请求
发送标准的聊天补全请求以开始生成文本。模型 ID 始终为 uncensored。该模型是一个开放权重的 LLM,经过调整可在合法成人用途中无内容拒绝地回答问题。它不是 GPT、格普蒂 或任何其他厂商的模型。
将model字段设置为uncensored。以标准数组格式提供您的消息。API 返回文本响应。您可以使用max_tokens控制输出长度。如果未设置,默认最大输出为 2,048 token。
Python SDK 集成
使用官方 OpenAI Python 库与 API 交互。您只需配置基础 URL 和 API 密钥。库的其余部分按预期工作。这包括对流式输出、函数调用和 JSON 模式的支持。
使用pip install openai安装库。使用您的基础 URL 和密钥初始化客户端。向聊天补全接口发送消息。响应对象包含生成的文本、token 使用情况和完成原因。您可以直接在 Python 代码中访问这些字段。
Node SDK 集成
Node.js SDK 的工作方式与 Python 版本相同。安装包并配置基础 URL。客户端自动处理认证和请求格式化。这使您可以快速将 API 集成到后端服务中。
将基础 URL 和 API 密钥传递给 OpenAI 客户端构造函数。使用chat.completions.create方法。响应结构符合 OpenAI 标准。你可以处理错误、检查 token 用量并处理内容。这种方法确保与已使用 OpenAI 的现有代码库兼容。
流式响应
通过在请求中设置stream: true启用流式输出。API 返回一系列 Server-Sent Events (SSE)。每个事件包含响应的一个 chunk。这允许您在生成文本时向用户显示文本。
最后一个 chunk 包含 token 使用统计。这对于跟踪成本很有用。流式输出减少了用户的感知延迟。建议用于聊天界面。您可以在客户端代码中解析事件以构建最终响应或实时显示 token。
限制、错误和上下文
该模型支持 100,000 token 的上下文窗口。这包括提示词和补全。每次请求的最大输出为 32,000 token。您可以调整max_tokens参数来控制这一点。
速率限制设置为每个密钥每分钟 300 次请求。你可以有 8 个并发请求。请求体必须小于 8 MB。如果密钥无效,你将收到 401 错误。如果没有额度,你将收到 402 错误。如果超过速率限制,你将收到 429 错误。错误和拒绝不会消耗额度。
cURL
curl https://api.minicpm.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);流式输出
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)接口能力与限制
所有限制、功能与价格一览。
| 项目 | 说明 |
|---|---|
| 接口格式 | 兼容 OpenAI:任何 OpenAI SDK 或客户端只需更换 base URL 和密钥 |
| Base URL | https://api.minicpm.cc/v1 |
| 模型 ID | uncensored |
| 认证 | Authorization: Bearer YOUR_KEY |
| 接口 | POST /v1/chat/completions · GET /v1/models |
| 采样参数 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 流式输出 | 支持 SSE,最后一块包含 token 用量 |
| 函数调用 | 支持 tools、tool_choice;回复包含 tool_calls(流式同样支持),结果以 role: tool 消息返回 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 上下文窗口 | 100,000 tokens(输入与输出合计) |
| 最大输出 | 不单独限制输出;提示+回复共 100,000 个 token 窗口内,max_tokens 可选 |
| 并发 | 每个密钥同时最多 8 个请求 |
| 请求大小 | 每次请求不超过 8 MB |
| 速率限制 | 每个密钥每分钟 300 次请求 |
| 响应头 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 计费 | 预付额度,按实际 token 用量扣费;错误和拒绝不收费 |
| 充值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整数金额 |
| 额度有效期 | 付费额度永不过期,无订阅 |
| 价格 | 输入 $0.25 / 百万 tokens · 输出 $1.00 / 百万 tokens |
| 免费试用 | $0.50,有效期 7 天,无需银行卡 · 试用密钥:2 个并发请求,每分钟 60 次;首次充值后恢复完整限额(8 和 300) |
| 赠送额度 | 满 $50 送 5%,满 $100 送 10% |
| 登录 | Google 或邮箱 + 密码 |
| 内容政策 | 允许成人内容;涉及未成年人的性内容一律拒绝 |
| 密钥 | 每个账户一个有效密钥;生成新密钥后旧密钥失效 |
错误代码
错误以 JSON 返回,type 字段固定;失败或被拒绝的请求不计费。
| 状态码 | 类型 | 含义 |
|---|---|---|
400 | bad_request | JSON 无效、消息为空、参数错误或超出上下文窗口 |
401 | missing_key · invalid_key · key_revoked | 缺少密钥、密钥错误或已被新密钥替换 |
402 | no_credit | 余额不足——充值后立即恢复 |
403 | content_blocked | 涉及未成年人的性内容——拒绝且不计费 |
404 | not_found | 未知接口 |
413 | request_too_large | 请求体超过 8 MB |
429 | rate_limited · concurrency | 超过每分钟 300 次或 8 个并发——稍后重试 |
503 | upstream_busy | 模型繁忙——几秒后重试 |
问答
上下文窗口大小是多少?
上下文窗口为 100,000 token,包含输入提示词和输出补全。每次请求的最大输出为 32,000 token。
我该如何处理错误?
401 错误表示 API 密钥无效。402 错误表示预付额度已耗尽。429 错误表示您超过了每分钟 300 次请求的速率限制。错误不会消耗您的额度。
我可以使用流式输出吗?
可以。在请求中设置 <code>stream: true</code>。API 返回 Server-Sent Events (SSE)。最后一个 chunk 包含 token 使用统计。
只差一张表单,即可获得密钥
创建账户,复制密钥,更改基础 URL。这就是全部设置。