5분 내 첫 요청
기반 URL과 API 키를 업데이트하여 요청을 무검열 엔드포인트로 라우팅하세요. OpenAI 호환 인터페이스는 기존 클라이언트 코드가 로직 변경 없이 작동함을 의미합니다.
기본 URL 및 인증
표준 OpenAI 기본 URL을 https://api.mistralapi.cc/v1로 바꾸세요. Authorization 헤더에 Bearer 토큰 형태로 API 키를 포함해야 합니다. 클라이언트를 무검열 서비스로 전환하는 데 필요한 유일한 구성 변경입니다. Google 또는 이메일로 API 키 생성 페이지를 통해 키를 발급할 수 있습니다. 키를 안전하게 보관하세요. 이 키는 선불 크레딧에 접근할 수 있습니다.
채팅 완료 보내기
표준 POST /v1/chat/completions 요청을 수행하세요. 모델을 uncensored로 설정하세요. API는 텍스트 입력을 받아 텍스트 출력을 반환합니다. 이미지, 오디오, 임베딩은 지원되지 않습니다. temperature, top_p, stop, seed 및 페널티 파라미터로 동작을 제어할 수 있습니다. 제한을 초과하거나 인증에 실패한 요청은 크레딧을 소모하지 않습니다.
curl https://api.mistralapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK 통합
공식 openai Python 패키지를 사용하세요. 새 기반 URL과 키로 클라이언트를 초기화하세요. chat.completions.create() 메서드를 uncensored 모델 ID와 함께 호출하세요. 이 접근 방식은 모든 OpenAI 호환 클라이언트 라이브러리에서 작동합니다. 이 서비스는 복잡한 구독보다 간단한 선불 토큰 결제를 선호하는 개발자를 위해 설계되었습니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK 통합
커스텀 기반 URL로 Node.js OpenAI SDK를 초기화하세요. 옵션에 API 키를 전달하세요. chat.completions.create() 메서드를 uncensored 모델과 함께 사용하세요. 이를 통해 기존 TypeScript 또는 JavaScript 로직을 유지하면서 합법적인 성인 주제나 논쟁적인 주제를 거부하지 않는 무검열 모델에 접근할 수 있습니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
스트리밍 응답
stream: true를 설정하여 스트리밍을 활성화합니다. API는 서버 전송 이벤트(SSE)를 통해 청크를 반환합니다. 토큰 사용량 통계는 스트림의 마지막 청크에 포함됩니다. 이를 통해 전체 응답을 기다리지 않고도 실시간으로 출력을 표시할 수 있습니다. 스트림을 구문 분석하여 UI를 단계적으로 업데이트할 수 있습니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
속도 제한 및 컨텍스트 창
각 API 키는 분당 300개 요청 및 동시 8개 요청으로 제한됩니다. 요청 본문은 8 MB를 초과할 수 없습니다. 컨텍스트 창은 프롬프트 및 완성 텍스트를 포함해 총 100,000 토큰입니다. 요청당 최대 출력은 32,000 토큰입니다 (max_tokens이 설정되지 않은 경우 2,048). 키에 충분한 크레딧이 없으면 요청이 실패합니다. 키가 유효하지 않거나 제거된 경우 인증 오류가 발생합니다. 속도 제한을 초과하면 표준 HTTP 429 오류가 반환됩니다.
질문과 답변
API는 함수 호출을 지원하나요?
네, 채팅 완료 요청에 <code>tools</code> 및 <code>tool_choice</code> 매개변수를 사용할 수 있습니다. 모델은 신뢰할 수 있는 JSON 생성을 위해 <code>response_format: json_object</code>를 통해 구조화된 출력을 지원합니다.
속도 제한을 초과하면 어떻게 되나요?
분당 300개 또는 키당 동시 8개 제한을 초과하는 요청은 실패합니다. 이 오류는 선불 크레딧을 소모하지 않습니다. 이전 키를 대체할 새 키를 생성하여 한도를 초기화할 수 있습니다.
무검열 모델이 Grok나 Llama와 동일한가요?
아니요. 자체 서버에서 실행되는 오픈 웨이트 모델로, 콘텐츠 거부 없이 답변하도록 튜닝되었습니다. GPT, Claude, Gemini, Grok, DeepSeek, Qwen 또는 Llama가 아닙니다. OpenAI 호환 인터페이스를 통해 제공되는 별도의 모델입니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 모델 ID | uncensored |
| Base URL | https://api.mistralapi.cc/v1 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 동시 요청 | 키당 동시 8개 |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |