Pierwsze zapytanie w pięć minut
Zaktualizuj swój bazowy URL i klucz API, aby kierować zapytania do naszego endpointa bez cenzury. Interfejs kompatybilny z OpenAI oznacza, że Twój istniejący kod klienta działa bez zmian logiki.
Bazowy URL i uwierzytelnianie
Zamień standardowy bazowy URL OpenAI na https://api.mistralapi.cc/v1. Musisz dołączyć swój klucz API w nagłówku Authorization jako token Bearer. To jedyna zmiana konfiguracji wymagana do przełączenia klienta na naszą usługę bez cenzury. Możesz wygenerować klucz na stronie Pobierz klucz API używając Google lub e-maila. Chroń swój klucz; zapewnia dostęp do Twojego przedpłaconego kredytu.
Wysyłanie uzupełnienia czatu
Wyślij standardowe zapytanie POST /v1/chat/completions. Ustaw model na uncensored. API przyjmuje dane tekstowe i zwraca wynik tekstowy. Nie obsługuje obrazów, dźwięku ani embeddingów. Możesz sterować zachowaniem za pomocą parametrów takich jak temperature, top_p, stop, seed oraz kar. Zapytania przekraczające limity lub nieprzechodzące uwierzytelnianie nie zużywają kredytu.
curl https://api.mistralapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Integracja z Python SDK
Użyj oficjalnego pakietu Pythona openai. Zainicjuj klienta podając nowy URL bazowy i swój klucz. Wywołaj chat.completions.create() z identyfikatorem modelu uncensored. To podejście działa z każdą biblioteką klienta kompatybilną z OpenAI. Usługa została zaprojektowana z myślą o deweloperach, którzy preferują proste rozliczanie za tokeny w modelu prepaid zamiast złożonych subskrypcji.
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Integracja z Node SDK
Zainicjuj SDK OpenAI dla Node.js z niestandardowym adresem bazowym. Przekaż swój klucz API w opcjach. Użyj metody chat.completions.create() z modelem uncensored. Pozwoli to zachować istniejącą logikę TypeScript lub JavaScript, zyskując jednocześnie dostęp do modelu bez cenzury, który nie odrzuca legalnych treści dla dorosłych ani tematów kontrowersyjnych.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true. API zwraca chunki za pomocą Server-Sent Events (SSE). Statystyki użycia tokenów są zawarte w ostatnim chunku strumienia. Pozwala to wyświetlać wynik w czasie rzeczywistym bez czekania na pełną odpowiedź. Możesz parsować strumień, aby aktualizować interfejs użytkownika progresywnie.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limity zapytań i okno kontekstu
Każdy klucz API jest ograniczony do 300 zapytań na minutę i 8 równoległych zapytań. Ciało zapytania nie może przekraczać 8 MB. Okno kontekstu wynosi łącznie 100 000 tokenów, wliczając prompt i uzupełnienie. Maksymalna długość wyniku na zapytanie to 32 000 tokenów (2 048, jeśli nie ustawiono max_tokens). Jeśli Twój klucz nie ma wystarczającego kredytu, zapytanie zostanie odrzucone. Błędy uwierzytelniania występują, gdy klucz jest nieprawidłowy lub usunięty. Przekroczenie limitów zapytań zwraca standardowe błędy HTTP 429.
Pytania i odpowiedzi
Czy API obsługuje wywoływanie funkcji?
Tak, możesz użyć parametrów <code>tools</code> i <code>tool_choice</code> w zapytaniach o uzupełnienie czatu. Model obsługuje wyjścia strukturalne poprzez <code>response_format: json_object</code> dla niezawodnej generacji JSON.
Co się stanie, gdy przekroczę limit zapytań?
Zapytania przekraczające limit 300 na minutę lub 8 równoległych na klucz zostaną odrzucone. Te błędy nie zużywają Twojego przedpłaconego kredytu. Możesz wygenerować nowy klucz, aby zastąpić stary, co zresetuje limity.
Czy model bez cenzury jest taki sam jak Grok lub Llama?
Nie. To model o otwartych wagach uruchamiany na naszych serwerach, dostrojony do odpowiadania bez odmów treści. Nie jest to GPT, Claude, Gemini, Grok, DeepSeek, Qwen ani Llama. To odrębny model obsługiwany przez interfejs kompatybilny z OpenAI.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Base URL | https://api.mistralapi.cc/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Tryb JSON | response_format: {"type": "json_object"} |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Bonus | +5% od $50, +10% od $100 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |