Snelstart voor Minicpm-gebruikers
Verbind je bestaande OpenAI-compatibele client binnen een minuut met onze ongecensureerde API. Vervang je base URL, stel je sleutel in en begin met het genereren van tekst met het "uncensored" model.
Base URL en Authenticatie
Voor gebruik van deze API heb je een API-sleutel en de juiste base URL nodig. Onze service is volledig compatibel met de standaard OpenAI-clientbibliotheken. Je hoeft geen nieuwe afhankelijkheden te installeren of een nieuwe SDK te leren. Wijs je bestaande client eenvoudig naar onze endpoint.
Genereer een sleutel op de API-sleutel ophalen pagina. Je kunt inloggen met Google of een e-mail en wachtwoord gebruiken. De sleutel wordt direct weergegeven. Bewaar deze veilig. Elk verzoek moet deze sleutel bevatten in de Authorization header.
De base URL voor alle verzoeken is: https://api.minicpm.cc/v1. Deze URL verwerkt chatcompleties, modellijsten en streaming-responses. Er zijn geen aparte endpoints voor embeddings of vision. Dit is een tekst-API.
Eerste Verzoek
Stuur een standaard chatcompletie-verzoek om tekst te genereren. De model-ID is altijd uncensored. Dit model is een open-weight large language model dat is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik. Het is geen GPT, Claude of een model van een andere leverancier.
Stel het model veld in op uncensored. Geef je berichten op in het standaard array formaat. De API retourneert een tekst reactie. Je kunt de output lengte beheren met max_tokens. Als je dit niet instelt, is de standaard max output 2.048 tokens.
Python SDK Integratie
Gebruik de officiële OpenAI Python library om met de API te communiceren. Je hoeft alleen de base URL en API-sleutel te configureren. De rest van de library werkt zoals verwacht. Dit omvat ondersteuning voor streaming, function calling en JSON-modus.
Installeer de library met pip install openai. Initialiseer de client met je base URL en sleutel. Stuur berichten naar de chat completions endpoint. Het response object bevat de gegenereerde tekst, token usage en finish reason. Je kunt deze velden direct in je Python code benaderen.
Node SDK Integratie
De Node.js SDK werkt identiek aan de Python versie. Installeer het package en configureer de base URL. De client behandelt authenticatie en request formatting automatisch. Hierdoor kun je de API snel integreren in je backend services.
Geef de base URL en API-sleutel mee aan de OpenAI client constructor. Gebruik de chat.completions.create methode. De response structuur komt overeen met de OpenAI standaard. Je kunt fouten afhandelen, token usage controleren en de content verwerken. Deze aanpak zorgt voor compatibiliteit met bestaande codebases die al OpenAI gebruiken.
Streaming Reacties
Schakel streaming in door stream: true in te stellen in je verzoek. De API retourneert een reeks Server-Sent Events (SSE). Elk event bevat een chunk van de reactie. Hiermee kun je tekst direct aan de gebruiker tonen terwijl deze wordt gegenereerd.
De laatste chunk bevat de token usage statistieken. Dit is handig voor het bijhouden van kosten. Streaming vermindert de perceived latency voor gebruikers. Het wordt aanbevolen voor chat interfaces. Je kunt de events in je client code parseren om de finale response te bouwen of tokens in real time weer te geven.
Limieten, Fouten en Context
Het model ondersteunt een contextvenster van 100.000 tokens. Dit omvat zowel de prompt als de completion. De maximale output per verzoek is 32.000 tokens. Je kunt de max_tokens parameter aanpassen om dit te beheren.
Rate limits zijn ingesteld op 300 verzoeken per minuut per sleutel. Je kunt 8 gelijktijdige verzoeken hebben. De request body moet kleiner zijn dan 8 MB. Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen tegoed hebt, ontvang je een 402-fout. Als je het rate limit overschrijdt, ontvang je een 429-fout. Fouten en refusals verbruiken geen tegoed.
cURL
curl https://api.minicpm.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Base URL | https://api.minicpm.cc/v1 |
| Model-ID | uncensored |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| JSON-modus | response_format: {"type": "json_object"} |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inloggen | Google of e-mail en wachtwoord |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat is de grootte van het contextvenster?
Het contextvenster is 100.000 tokens, inclusief zowel de input prompt als de output completion. De maximale output per verzoek is 32.000 tokens.
Hoe ga ik om met fouten?
Een 401-fout geeft een ongeldige API-sleutel aan. Een 402-fout betekent dat je prepaid tegoed op is. Een 429-fout betekent dat je het rate limit van 300 verzoeken per minuut hebt overschreden. Fouten verbruiken geen tegoed.
Kan ik streaming gebruiken?
Ja. Stel <code>stream: true</code> in in je verzoek. De API retourneert Server-Sent Events (SSE). De laatste chunk bevat de token usage statistieken.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.