Erste Anfrage in fünf Minuten
Aktualisiere deine Basis-URL und deinen API-Schlüssel, um Anfragen an unseren unzensierten Endpunkt zu leiten. Die OpenAI-kompatible Schnittstelle bedeutet, dass dein bestehender Client-Code ohne Logikänderungen funktioniert.
Basis-URL und Authentifizierung
Ersetze deine Standard-OpenAI-Basis-URL durch https://api.mistralapi.cc/v1. Du musst deinen API-Schlüssel im Authorization-Header als Bearer-Token angeben. Dies ist die einzige Konfigurationsänderung, die erforderlich ist, um deinen Client auf unseren unzensierten Dienst umzustellen. Du kannst einen Schlüssel über die Seite API-Schlüssel erhalten generieren, indem du Google oder E-Mail verwendest. Bewahre deinen Schlüssel sicher auf; er gewährt Zugriff auf dein Prepaid-Guthaben.
Chat-Abschluss senden
Stelle eine Standard-POST /v1/chat/completions-Anfrage. Setze das Modell auf uncensored. Die API akzeptiert Texteingaben und gibt Textausgaben zurück. Sie unterstützt keine Bilder, Audio oder Embeddings. Du kannst das Verhalten mit Parametern wie temperature, top_p, stop, seed und Strafen steuern. Anfragen, die Limits überschreiten oder die Authentifizierung fehlschlägt, verbrauchen kein Guthaben.
curl https://api.mistralapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK-Integration
Verwende das offizielle openai Python-Paket. Initialisiere den Client mit der neuen Basis-URL und deinem Schlüssel. Rufe chat.completions.create() mit der Modell-ID uncensored auf. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek. Der Service ist für Entwickler gemacht, die eine einfache Prepaid-Token-Abrechnung komplexen Abonnements vorziehen.
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK-Integration
Initialisiere das Node.js OpenAI SDK mit der benutzerdefinierten Basis-URL. Übergebe deinen API-Schlüssel in den Optionen. Verwende die Methode chat.completions.create() mit dem Modell uncensored. Dies ermöglicht es dir, deine bestehende TypeScript- oder JavaScript-Logik beizubehalten und gleichzeitig Zugriff auf ein unzensiertes Modell zu erhalten, das keine rechtlich zulässigen erwachsenen oder kontroversen Themen ablehnt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Aktiviere Streaming, indem du stream: true setzt. Die API gibt Chunks über Server-Sent Events (SSE) zurück. Token-Nutzungsstatistiken sind im letzten Chunk des Streams enthalten. Dies ermöglicht es dir, Ausgaben in Echtzeit anzuzeigen, ohne auf die vollständige Antwort zu warten. Du kannst den Stream analysieren, um deine Benutzeroberfläche schrittweise zu aktualisieren.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ratenlimits und Kontextfenster
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute und 8 parallele Anfragen begrenzt. Der Anfragetext darf 8 MB nicht überschreiten. Das Kontextfenster umfasst insgesamt 100.000 Token, einschließlich Prompt und Completion. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token (2.048, wenn max_tokens nicht gesetzt ist). Wenn dein Schlüssel nicht über ausreichendes Guthaben verfügt, schlägt die Anfrage fehl. Authentifizierungsfehler treten auf, wenn der Schlüssel ungültig oder entfernt ist. Ratenlimits geben bei Überschreitung standardmäßige HTTP-429-Fehler zurück.
Fragen und Antworten
Unterstützt die API Function Calling?
Ja, du kannst die Parameter <code>tools</code> und <code>tool_choice</code> in deinen Chat-Abschluss-Anfragen verwenden. Das Modell unterstützt strukturierte Ausgaben über <code>response_format: json_object</code> für zuverlässige JSON-Generierung.
Was passiert, wenn ich das Ratenlimit überschreite?
Anfragen, die das Limit von 300 pro Minute oder 8 parallele Anfragen pro Schlüssel überschreiten, schlagen fehl. Diese Fehler verbrauchen kein Prepaid-Guthaben. Du kannst einen neuen Schlüssel generieren, um den alten zu ersetzen, wodurch die Limits zurückgesetzt werden.
Ist das unzensierte Modell dasselbe wie Grok oder Llama?
Nein. Es ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft und darauf abgestimmt ist, ohne Inhaltsfilterungen zu antworten. Es ist kein GPT, Claude, Gemini, Grok, DeepSeek, Qwen oder Llama. Es ist ein eigenständiges Modell, das über eine OpenAI-kompatible Schnittstelle bereitgestellt wird.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.
API-Spezifikation
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Base-URL | https://api.mistralapi.cc/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |