NL ▾
API-sleutel aanvragen

Eerste verzoek in vijf minuten

Update je base URL en API-sleutel om verzoeken naar onze ongecensureerde endpoint te routeren. De OpenAI-compatibele interface betekent dat je bestaande clientcode zonder logica-aanpassingen werkt.

Base URL en Authenticatie

Vervang je standaard OpenAI base URL door https://api.mistralapi.cc/v1. Je moet je API-sleutel opnemen in de Authorization header als Bearer token. Dit is de enige configuratiewijziging die nodig is om je client naar onze ongecensureerde service te schakelen. Je kunt een sleutel genereren via de API-sleutel ophalen pagina met Google of e-mail. Houd je sleutel veilig; deze geeft toegang tot je prepaid tegoed.

Stuur een Chat Completion

Maak een standaard POST /v1/chat/completions verzoek. Stel het model in op uncensored. De API accepteert tekstinput en retourneert tekstoutput. Het ondersteunt geen afbeeldingen, audio of embeddings. Je kunt het gedrag beheren met parameters zoals temperature, top_p, stop, seed en strafparameters. Verzoeken die de limieten overschrijden of waarbij de authenticatie mislukt, verbruiken geen tegoed.

curl https://api.mistralapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK Integratie

Gebruik de officiële openai Python package. Initialiseer de client met de nieuwe basis-URL en je sleutel. Roep chat.completions.create() aan met de model-ID uncensored. Deze aanpak werkt voor elke OpenAI-compatibele client library. De service is ontworpen voor ontwikkelaars die de eenvoudige prepaid token-billing verkiezen boven complexe abonnementen.

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK Integratie

Initialiseer de Node.js OpenAI SDK met de aangepaste base URL. Geef je API-sleutel door in de opties. Gebruik de chat.completions.create() methode met het uncensored model. Dit stelt je in staat je bestaande TypeScript of JavaScript logica intact te houden terwijl je toegang krijgt tot een ongecensureerd model dat geen wettelijke volwassen of controversiële onderwerpen weigert.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming Responsen

Schakel streaming in door stream: true in te stellen. De API retourneert chunks via Server-Sent Events (SSE). Token-gebruikstatistieken zijn opgenomen in de laatste chunk van de stream. Dit stelt je in staat output in real-time weer te geven zonder te wachten op de volledige respons. Je kunt de stream parseren om je UI progressief bij te werken.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Rate Limits en Contextvenster

Elke API-sleutel is beperkt tot 300 verzoeken per minuut en 8 gelijktijdige verzoeken. De request body mag niet groter zijn dan 8 MB. Het contextvenster is 100.000 tokens totaal, inclusief prompt en completion. De maximale output per verzoek is 32.000 tokens (2.048 als max_tokens niet is ingesteld). Als je sleutel onvoldoende tegoed heeft, faalt het verzoek. Authenticatiefouten treden op als de sleutel ongeldig of verwijderd is. Rate limits retourneren standaard HTTP 429 fouten bij overschrijding.

Vragen en antwoorden

Ondersteunt de API function calling?

Ja, je kunt de parameters <code>tools</code> en <code>tool_choice</code> gebruiken in je chat completion-verzoeken. Het model ondersteunt gestructureerde outputs via <code>response_format: json_object</code> voor betrouwbare JSON-generatie.

Wat gebeurt er als ik de rate limit overschrijd?

Verzoeken die de limiet van 300 per minuut of 8 gelijktijdige verzoeken per sleutel overschrijden, falen. Deze fouten verbruiken geen prepaid tegoed. Je kunt een nieuwe sleutel genereren om de oude te vervangen, wat je limieten reset.

Is het ongecensureerde model hetzelfde als Grok of Llama?

Nee. Het is een open-weight model dat op onze eigen servers draait, afgestemd op antwoorden zonder inhoudsrefusies. Het is geen GPT, Claude, Gemini, Grok, DeepSeek, Qwen of Llama. Het is een apart model dat wordt aangeboden via een OpenAI-compatibele interface.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel aanvragen

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
Base URLhttps://api.mistralapi.cc/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
Contextvenster100.000 tokens (invoer + uitvoer)
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-modusresponse_format: {"type": "json_object"}
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw