DE ▾
API-Schlüssel erhalten

Erste Anfrage in fünf Minuten

Aktualisiere deine Basis-URL und deinen API-Schlüssel, um Anfragen an unseren unzensierten Endpunkt zu leiten. Die OpenAI-kompatible Schnittstelle bedeutet, dass dein bestehender Client-Code ohne Logikänderungen funktioniert.

Basis-URL und Authentifizierung

Ersetze deine Standard-OpenAI-Basis-URL durch https://api.mistralapi.cc/v1. Du musst deinen API-Schlüssel im Authorization-Header als Bearer-Token angeben. Dies ist die einzige Konfigurationsänderung, die erforderlich ist, um deinen Client auf unseren unzensierten Dienst umzustellen. Du kannst einen Schlüssel über die Seite API-Schlüssel erhalten generieren, indem du Google oder E-Mail verwendest. Bewahre deinen Schlüssel sicher auf; er gewährt Zugriff auf dein Prepaid-Guthaben.

Chat-Abschluss senden

Stelle eine Standard-POST /v1/chat/completions-Anfrage. Setze das Modell auf uncensored. Die API akzeptiert Texteingaben und gibt Textausgaben zurück. Sie unterstützt keine Bilder, Audio oder Embeddings. Du kannst das Verhalten mit Parametern wie temperature, top_p, stop, seed und Strafen steuern. Anfragen, die Limits überschreiten oder die Authentifizierung fehlschlägt, verbrauchen kein Guthaben.

curl https://api.mistralapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK-Integration

Verwende das offizielle openai Python-Paket. Initialisiere den Client mit der neuen Basis-URL und deinem Schlüssel. Rufe chat.completions.create() mit der Modell-ID uncensored auf. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek. Der Service ist für Entwickler gemacht, die eine einfache Prepaid-Token-Abrechnung komplexen Abonnements vorziehen.

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK-Integration

Initialisiere das Node.js OpenAI SDK mit der benutzerdefinierten Basis-URL. Übergebe deinen API-Schlüssel in den Optionen. Verwende die Methode chat.completions.create() mit dem Modell uncensored. Dies ermöglicht es dir, deine bestehende TypeScript- oder JavaScript-Logik beizubehalten und gleichzeitig Zugriff auf ein unzensiertes Modell zu erhalten, das keine rechtlich zulässigen erwachsenen oder kontroversen Themen ablehnt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Aktiviere Streaming, indem du stream: true setzt. Die API gibt Chunks über Server-Sent Events (SSE) zurück. Token-Nutzungsstatistiken sind im letzten Chunk des Streams enthalten. Dies ermöglicht es dir, Ausgaben in Echtzeit anzuzeigen, ohne auf die vollständige Antwort zu warten. Du kannst den Stream analysieren, um deine Benutzeroberfläche schrittweise zu aktualisieren.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ratenlimits und Kontextfenster

Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 parallele Anfragen begrenzt. Der Anfragetext darf 8 MB nicht überschreiten. Das Kontextfenster umfasst insgesamt 100.000 Token, einschließlich Prompt und Completion. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token (2.048, wenn max_tokens nicht gesetzt ist). Wenn dein Schlüssel nicht über ausreichendes Guthaben verfügt, schlägt die Anfrage fehl. Authentifizierungsfehler treten auf, wenn der Schlüssel ungültig oder entfernt ist. Ratenlimits geben bei Überschreitung standardmäßige HTTP-429-Fehler zurück.

Fragen und Antworten

Unterstützt die API Function Calling?

Ja, du kannst die Parameter <code>tools</code> und <code>tool_choice</code> in deinen Chat-Abschluss-Anfragen verwenden. Das Modell unterstützt strukturierte Ausgaben über <code>response_format: json_object</code> für zuverlässige JSON-Generierung.

Was passiert, wenn ich das Ratenlimit überschreite?

Anfragen, die das Limit von 300 pro Minute oder 8 parallele Anfragen pro Schlüssel überschreiten, schlagen fehl. Diese Fehler verbrauchen kein Prepaid-Guthaben. Du kannst einen neuen Schlüssel generieren, um den alten zu ersetzen, wodurch die Limits zurückgesetzt werden.

Ist das unzensierte Modell dasselbe wie Grok oder Llama?

Nein. Es ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft und darauf abgestimmt ist, ohne Inhaltsfilterungen zu antworten. Es ist kein GPT, Claude, Gemini, Grok, DeepSeek, Qwen oder Llama. Es ist ein eigenständiges Modell, das über eine OpenAI-kompatible Schnittstelle bereitgestellt wird.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten

API-Spezifikation

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
Base-URLhttps://api.mistralapi.cc/v1
AuthentifizierungAuthorization: Bearer YOUR_KEY
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-Modusresponse_format: {"type": "json_object"}
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen