FR ▾
Obtenir une clé API

Première requête en cinq minutes

Mettez à jour votre URL de base et votre clé API pour acheminer les requêtes vers notre endpoint sans censure. L'interface compatible OpenAI signifie que votre code client existant fonctionne sans modifications de logique.

URL de base et authentification

Remplacez votre URL de base OpenAI standard par https://api.mistralapi.cc/v1. Vous devez inclure votre clé API dans l'en-tête Authorization sous forme de jeton Bearer. C'est la seule modification de configuration requise pour basculer votre client vers notre service sans censure. Vous pouvez générer une clé via la page Obtenir clé API en utilisant Google ou e-mail. Conservez votre clé en sécurité ; elle donne accès à votre crédit prépayé.

Envoyer une complétion de chat

Envoyez une requête POST /v1/chat/completions standard. Définissez le modèle sur uncensored. L'API accepte un texte en entrée et renvoie du texte en sortie. Elle ne prend pas en charge les images, l'audio ni les embeddings. Vous pouvez contrôler le comportement à l'aide de paramètres tels que temperature, top_p, stop, seed et les pénalités. Les requêtes qui dépassent les limites ou échouent à l'authentification ne consomment pas de crédit.

curl https://api.mistralapi.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Intégration SDK Python

Utilisez le package Python officiel openai. Initialisez le client avec l'URL de base et votre clé. Appelez chat.completions.create() avec l'ID du modèle uncensored. Cette approche fonctionne avec n'importe quelle bibliothèque cliente compatible OpenAI. Le service est conçu pour les développeurs qui préfèrent une facturation simple en tokens prépayés à des abonnements complexes.

from openai import OpenAI

client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Intégration SDK Node.js

Initialisez le SDK OpenAI pour Node.js avec l'URL de base personnalisée. Transmettez votre clé API dans les options. Utilisez la méthode chat.completions.create() avec le modèle uncensored. Cela vous permet de conserver votre logique TypeScript ou JavaScript existante tout en accédant à un modèle sans censure qui n'accepte pas les sujets adultes ou controversés.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Activez le streaming en définissant stream: true. L'API renvoie des segments via Server-Sent Events (SSE). Les statistiques d'utilisation des tokens sont incluses dans le dernier segment du flux. Cela vous permet d'afficher la sortie en temps réel sans attendre la réponse complète. Vous pouvez analyser le flux pour mettre à jour votre interface utilisateur de manière progressive.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites de débit et fenêtre de contexte

Chaque clé API est limitée à 300 requêtes par minute et à 8 requêtes simultanées. Le corps de la requête ne doit pas dépasser 8 Mo. La fenêtre de contexte est de 100 000 tokens au total, incluant le prompt et la complétion. Le maximum de sortie par requête est de 32 000 tokens (2 048 si max_tokens n'est pas défini). Si votre clé ne dispose pas de crédit suffisant, la requête échoue. Les erreurs d'authentification surviennent si la clé est invalide ou supprimée. Les limites de débit renvoient des erreurs HTTP 429 standard lorsqu'elles sont dépassées.

Questions et réponses

L'API prend-elle en charge l'appel de fonctions ?

Oui, vous pouvez utiliser les paramètres <code>tools</code> et <code>tool_choice</code> dans vos requêtes de complétion de chat. Le modèle prend en charge les sorties structurées via <code>response_format: json_object</code> pour une génération JSON fiable.

Que se passe-t-il si je dépasse la limite de débit ?

Les requêtes dépassant les 300 par minute ou les 8 requêtes simultanées par clé échoueront. Ces erreurs ne consomment pas votre crédit prépayé. Vous pouvez générer une nouvelle clé pour remplacer l'ancienne, ce qui réinitialise vos limites.

Le modèle sans censure est-il identique à Grok ou Llama ?

Non. Il s'agit d'un modèle à poids ouverts exécuté sur nos propres serveurs, ajusté pour répondre sans refus de contenu. Ce n'est ni GPT, ni Claude, ni Gemini, ni Grok, ni DeepSeek, ni Qwen, ni Llama. C'est un modèle distinct servi via une interface compatible OpenAI.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
Base URLhttps://api.mistralapi.cc/v1
AuthentificationAuthorization: Bearer YOUR_KEY
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Mode JSONresponse_format: {"type": "json_object"}
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Bonus+5 % dès 50 $, +10 % dès 100 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Validitéle crédit payé n'expire jamais, sans abonnement
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
ConnexionGoogle ou e-mail et mot de passe

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes