Yêu cầu đầu tiên trong 5 phút
Cập nhật URL cơ sở và khóa API của bạn để định tuyến các yêu cầu đến endpoint không kiểm duyệt của chúng tôi. Giao diện tương thích OpenAI có nghĩa là mã khách hàng hiện có của bạn hoạt động mà không cần thay đổi logic.
URL cơ sở và Xác thực
Thay thế URL cơ sở OpenAI tiêu chuẩn của bạn bằng https://api.mistralapi.cc/v1. Bạn phải bao gồm khóa API của mình trong tiêu đề Authorization dưới dạng token Bearer. Đây là thay đổi cấu hình duy nhất cần thiết để chuyển client của bạn sang dịch vụ không kiểm duyệt của chúng tôi. Bạn có thể tạo khóa thông qua trang Lấy khóa API bằng Google hoặc email. Giữ khóa của bạn an toàn; nó cung cấp quyền truy cập vào tín dụng trả trước của bạn.
Gửi yêu cầu Hoàn thành Hội thoại
Thực hiện yêu cầu POST /v1/chat/completions tiêu chuẩn. Đặt mô hình thành uncensored. API chấp nhận đầu vào văn bản và trả về đầu ra văn bản. API không hỗ trợ hình ảnh, âm thanh hoặc embedding. Bạn có thể kiểm soát hành vi bằng các tham số như temperature, top_p, stop, seed và các hình phạt. Các yêu cầu vượt quá giới hạn hoặc xác thực không thành công sẽ không tiêu tốn tín dụng.
curl https://api.mistralapi.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Tích hợp SDK Python
Sử dụng gói Python openai chính thức. Khởi tạo máy khách với URL cơ sở mới và khóa của bạn. Gọi chat.completions.create() với ID mô hình uncensored. Cách tiếp cận này hoạt động cho bất kỳ thư viện máy khách tương thích OpenAI nào. Dịch vụ được thiết kế cho các nhà phát triển thích thanh toán token trả trước đơn giản hơn là đăng ký phức tạp.
from openai import OpenAI
client = OpenAI(base_url="https://api.mistralapi.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Tích hợp SDK Node.js
Khởi tạo SDK OpenAI cho Node.js với URL cơ sở tùy chỉnh. Truyền khóa API của bạn trong các tùy chọn. Sử dụng phương thức chat.completions.create() với mô hình uncensored. Điều này cho phép bạn giữ nguyên logic TypeScript hoặc JavaScript hiện có trong khi truy cập vào một mô hình không kiểm duyệt không từ chối các chủ đề người trưởng thành hợp pháp hoặc gây tranh cãi.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mistralapi.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Phản hồi Truyền phát
Bật truyền phát bằng cách đặt stream: true. API trả về các chunk qua Server-Sent Events (SSE). Thống kê sử dụng token được bao gồm trong chunk cuối cùng của luồng. Điều này cho phép bạn hiển thị đầu ra theo thời gian thực mà không cần chờ phản hồi đầy đủ. Bạn có thể phân tích luồng để cập nhật giao diện người dùng của mình một cách tuần tự.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Giới hạn Tốc độ và Cửa sổ Ngữ cảnh
Mỗi khóa API bị giới hạn ở 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Cửa sổ ngữ cảnh là 100.000 token tổng cộng, bao gồm prompt và completion. Đầu ra tối đa mỗi yêu cầu là 32.000 token (2.048 nếu max_tokens không được đặt). Nếu khóa của bạn không có đủ tín dụng, yêu cầu sẽ thất bại. Lỗi xác thực xảy ra nếu khóa không hợp lệ hoặc bị xóa. Giới hạn tốc độ trả về lỗi HTTP 429 tiêu chuẩn khi vượt quá.
Hỏi đáp
API có hỗ trợ gọi hàm không?
Có, bạn có thể sử dụng các tham số <code>tools</code> và <code>tool_choice</code> trong các yêu cầu hoàn thành hội thoại của bạn. Mô hình hỗ trợ đầu ra có cấu trúc thông qua <code>response_format: json_object</code> để tạo JSON đáng tin cậy.
Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ?
Các yêu cầu vượt quá giới hạn 300 mỗi phút hoặc 8 yêu cầu đồng thời mỗi khóa sẽ bị lỗi. Các lỗi này không tiêu tốn tín dụng trả trước của bạn. Bạn có thể tạo một khóa mới để thay thế khóa cũ, điều này sẽ đặt lại giới hạn của bạn.
Mô hình không kiểm duyệt có giống với Grok hay Llama không?
Không. Đó là một mô hình trọng số mở chạy trên máy chủ của riêng chúng tôi, được tinh chỉnh để trả lời mà không từ chối nội dung. Nó không phải là GPT, Claude, Gemini, Grok, DeepSeek, Qwen hay Llama. Đó là một mô hình riêng biệt được cung cấp qua giao diện tương thích với OpenAI.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID mô hình | uncensored |
| Base URL | https://api.mistralapi.cc/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Thưởng | +5% từ $50, +10% từ $100 |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |