Prima richiesta in cinque minuti
Aggiorna il tuo URL base e la chiave API per instradare le richieste al nostro endpoint senza censura. L'interfaccia compatibile con OpenAI significa che il tuo codice client esistente funziona senza modifiche alla logica.
URL base e autenticazione
Sostituisci il tuo URL base standard di OpenAI con https://api.mistralapi.cc/v1. Devi includere la tua chiave API nell'header Authorization come token Bearer. Questa è l'unica modifica di configurazione necessaria per passare il tuo client al nostro servizio senza censura. Puoi generare una chiave tramite la pagina Ottieni chiave API usando Google o l'email. Tieni la tua chiave al sicuro; fornisce l'accesso al tuo credito prepagato.
Invia un completamento chat
Esegui una richiesta standard POST /v1/chat/completions. Imposta il modello su uncensored. L'API accetta input testuale e restituisce output testuale. Non supporta immagini, audio o embedding. Puoi controllare il comportamento usando parametri come temperature, top_p, stop, seed e penalità. Le richieste che superano i limiti o falliscono l'autenticazione non consumano credito.
curl https://api.mistralapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integrazione SDK Python
Usa il pacchetto Python ufficiale openai. Inizializza il client con il nuovo URL base e la tua chiave. Chiama chat.completions.create() con l'ID del modello uncensored. Questo approccio funziona per qualsiasi libreria client compatibile con OpenAI. Il servizio è pensato per gli sviluppatori che preferiscono una fatturazione semplice dei token prepagati rispetto ad abbonamenti complessi.
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integrazione SDK Node.js
Inizializza l'SDK OpenAI Node.js con l'URL base personalizzato. Passa la tua chiave API nelle opzioni. Usa il metodo chat.completions.create() con il modello uncensored. Questo ti permette di mantenere intatta la tua logica TypeScript o JavaScript mentre ottieni accesso a un modello senza censura che non rifiuta argomenti adulti leciti o controversi.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Abilita lo streaming impostando stream: true. L'API restituisce chunk tramite Server-Sent Events (SSE). Le statistiche di utilizzo dei token sono incluse nell'ultimo chunk dello stream. Questo ti permette di visualizzare l'output in tempo reale senza attendere la risposta completa. Puoi analizzare lo stream per aggiornare la tua UI in modo progressivo.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di richiesta e finestra di contesto
Ogni chiave API è limitata a 300 richieste al minuto e 8 richieste parallele. Il corpo della richiesta non deve superare gli 8 MB. La finestra di contesto è di 100.000 token in totale, inclusi prompt e completamento. L'output massimo per richiesta è di 32.000 token (2.048 se max_tokens non è impostato). Se la tua chiave non ha credito sufficiente, la richiesta fallisce. Gli errori di autenticazione si verificano se la chiave non è valida o è stata rimossa. I limiti di richieste restituiscono errori HTTP 429 standard quando superati.
Domande e risposte
L'API supporta la chiamata di funzioni?
Sì, puoi usare i parametri <code>tools</code> e <code>tool_choice</code> nelle tue richieste di completamento chat. Il modello supporta output strutturati tramite <code>response_format: json_object</code> per una generazione JSON affidabile.
Cosa succede se supero il limite di richieste?
Le richieste che superano il limite di 300 al minuto o 8 concorrenti per chiave falliranno. Questi errori non consumano il tuo credito prepagato. Puoi generare una nuova chiave per sostituire quella vecchia, resettando i limiti.
Il modello senza censura è uguale a Grok o Llama?
No. È un modello a pesi aperti eseguito sui nostri server, ottimizzato per rispondere senza rifiuti sui contenuti. Non è GPT, Claude, Gemini, Grok, DeepSeek, Qwen o Llama. È un modello distinto servito tramite un'interfaccia compatibile con OpenAI.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta la configurazione.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Base URL | https://api.mistralapi.cc/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |