NL ▾
API-sleutel aanvragen

Snelstart voor Minicpm-gebruikers

Verbind je bestaande OpenAI-compatibele client binnen een minuut met onze ongecensureerde API. Vervang je base URL, stel je sleutel in en begin met het genereren van tekst met het "uncensored" model.

Base URL en Authenticatie

Voor gebruik van deze API heb je een API-sleutel en de juiste base URL nodig. Onze service is volledig compatibel met de standaard OpenAI-clientbibliotheken. Je hoeft geen nieuwe afhankelijkheden te installeren of een nieuwe SDK te leren. Wijs je bestaande client eenvoudig naar onze endpoint.

Genereer een sleutel op de API-sleutel ophalen pagina. Je kunt inloggen met Google of een e-mail en wachtwoord gebruiken. De sleutel wordt direct weergegeven. Bewaar deze veilig. Elk verzoek moet deze sleutel bevatten in de Authorization header.

De base URL voor alle verzoeken is: https://api.minicpm.cc/v1. Deze URL verwerkt chatcompleties, modellijsten en streaming-responses. Er zijn geen aparte endpoints voor embeddings of vision. Dit is een tekst-API.

Eerste Verzoek

Stuur een standaard chatcompletie-verzoek om tekst te genereren. De model-ID is altijd uncensored. Dit model is een open-weight large language model dat is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik. Het is geen GPT, Claude of een model van een andere leverancier.

Stel het model veld in op uncensored. Geef je berichten op in het standaard array formaat. De API retourneert een tekst reactie. Je kunt de output lengte beheren met max_tokens. Als je dit niet instelt, is de standaard max output 2.048 tokens.

Python SDK Integratie

Gebruik de officiële OpenAI Python library om met de API te communiceren. Je hoeft alleen de base URL en API-sleutel te configureren. De rest van de library werkt zoals verwacht. Dit omvat ondersteuning voor streaming, function calling en JSON-modus.

Installeer de library met pip install openai. Initialiseer de client met je base URL en sleutel. Stuur berichten naar de chat completions endpoint. Het response object bevat de gegenereerde tekst, token usage en finish reason. Je kunt deze velden direct in je Python code benaderen.

Node SDK Integratie

De Node.js SDK werkt identiek aan de Python versie. Installeer het package en configureer de base URL. De client behandelt authenticatie en request formatting automatisch. Hierdoor kun je de API snel integreren in je backend services.

Geef de base URL en API-sleutel mee aan de OpenAI client constructor. Gebruik de chat.completions.create methode. De response structuur komt overeen met de OpenAI standaard. Je kunt fouten afhandelen, token usage controleren en de content verwerken. Deze aanpak zorgt voor compatibiliteit met bestaande codebases die al OpenAI gebruiken.

Streaming Reacties

Schakel streaming in door stream: true in te stellen in je verzoek. De API retourneert een reeks Server-Sent Events (SSE). Elk event bevat een chunk van de reactie. Hiermee kun je tekst direct aan de gebruiker tonen terwijl deze wordt gegenereerd.

De laatste chunk bevat de token usage statistieken. Dit is handig voor het bijhouden van kosten. Streaming vermindert de perceived latency voor gebruikers. Het wordt aanbevolen voor chat interfaces. Je kunt de events in je client code parseren om de finale response te bouwen of tokens in real time weer te geven.

Limieten, Fouten en Context

Het model ondersteunt een contextvenster van 100.000 tokens. Dit omvat zowel de prompt als de completion. De maximale output per verzoek is 32.000 tokens. Je kunt de max_tokens parameter aanpassen om dit te beheren.

Rate limits zijn ingesteld op 300 verzoeken per minuut per sleutel. Je kunt 8 gelijktijdige verzoeken hebben. De request body moet kleiner zijn dan 8 MB. Als de sleutel ongeldig is, ontvang je een 401-fout. Als je geen tegoed hebt, ontvang je een 402-fout. Als je het rate limit overschrijdt, ontvang je een 429-fout. Fouten en refusals verbruiken geen tegoed.

cURL

curl https://api.minicpm.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.minicpm.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.minicpm.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.minicpm.cc/v1
Model-IDuncensored
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster100.000 tokens (invoer + uitvoer)
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Bonus+5% vanaf $50, +10% vanaf $100
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat is de grootte van het contextvenster?

Het contextvenster is 100.000 tokens, inclusief zowel de input prompt als de output completion. De maximale output per verzoek is 32.000 tokens.

Hoe ga ik om met fouten?

Een 401-fout geeft een ongeldige API-sleutel aan. Een 402-fout betekent dat je prepaid tegoed op is. Een 429-fout betekent dat je het rate limit van 300 verzoeken per minuut hebt overschreden. Fouten verbruiken geen tegoed.

Kan ik streaming gebruiken?

Ja. Stel <code>stream: true</code> in in je verzoek. De API retourneert Server-Sent Events (SSE). De laatste chunk bevat de token usage statistieken.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.

API-sleutel ophalen