Khởi động nhanh API Uncensored LLM Online
Tích hợp API LLM không kiểm duyệt trực tuyến vào ứng dụng của bạn với hướng dẫn bắt đầu nhanh này. Sử dụng các endpoint tương thích OpenAI tiêu chuẩn để gửi các yêu cầu tạo văn bản thô, không lọc mà không cần quản lý cơ sở hạ tầng GPU.
- $0,25
- trên 1M token đầu vào
- $1,00
- Token đầu ra / 1M
- 100.000
- ngữ cảnh token
- $0,50
- tín dụng dùng thử miễn phí
- 300
- yêu cầu mỗi phút
URL cơ bản và Xác thực
API LLM không kiểm duyệt trực tuyến sử dụng các endpoint tương thích chuẩn với OpenAI. Bạn hãy định cấu hình client của mình để trỏ đến Base URL https://api.uncensoredllmonline.com/v1. Xác thực được xử lý thông qua khóa API được truyền trong tiêu đề Authorization. Bạn có thể tạo khóa của mình trên trang Lấy khóa API chỉ bằng email và mật khẩu. Khóa sẽ hiển thị ngay lập tức khi bạn đăng ký. Không cần số điện thoại hay thẻ tín dụng để bắt đầu. Mỗi tài khoản chỉ giữ một khóa hoạt động, khóa này có thể được tạo lại bất cứ lúc nào để thu hồi quyền truy cập của khóa cũ. Hãy giữ khóa của bạn an toàn vì nó cung cấp quyền truy cập trực tiếp vào tín dụng trả trước của bạn.
Endpoint Chat Completions
Gửi văn bản đến LLM không kiểm duyệt bằng cách posting vào POST /v1/chat/completions. Endpoint này chấp nhận một danh sách các tin nhắn và trả về phản hồi của mô hình. ID mô hình cần sử dụng là uncensored. Đây là một mô hình trọng số mở được tinh chỉnh để trả lời mà không từ chối nội dung, phù hợp cho người trưởng thành sử dụng hợp pháp. Đây không phải là GPT, Claude hay mô hình của nhà cung cấp khác. API trả về khả năng tạo văn bản thô, phù hợp cho các tích hợp tùy chỉnh. Bạn hãy sử dụng lệnh cURL sau để kiểm tra một yêu cầu cơ bản:
curl https://api.uncensoredllmonline.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Thân yêu cầu nên bao gồm ID mô hình và lịch sử tin nhắn của bạn. Đảm bảo client của bạn gửi tiêu đề Authorization: Bearer <your-key>. Phản hồi sẽ chứa văn bản được tạo, bạn có thể phân tích cú pháp và sử dụng trong logic ứng dụng của mình.
Tích hợp SDK Python
Sử dụng Python SDK chính thức của OpenAI để tương tác với mô hình AI không kiểm duyệt. Bạn hãy đặt base_url và api_key trong phần khởi tạo client của mình. Điều này cho phép bạn sử dụng các phương thức quen thuộc như chat.completions.create. Ví dụ sau đây minh họa cách khởi tạo client và gửi một truy vấn đơn giản:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Cách tiếp cận này cho phép bạn tận dụng các cấu trúc mã hiện có trong khi chuyển sang LLM không kiểm duyệt. SDK tự động xử lý việc tuần tự hóa JSON và phân tích cú pháp phản hồi. Hãy nhớ rằng ID mô hình phải được đặt thành uncensored để đảm bảo bạn đang truy cập đúng endpoint. Phương pháp này lý tưởng cho các nhà phát triển muốn giảm thiểu mã boilerplate.
Tích hợp SDK Node.js
Đối với các dự án JavaScript hoặc TypeScript, SDK Node.js của OpenAI hoạt động liền mạch với API của chúng tôi. Khởi tạo client với khóa API và URL cơ bản chính xác. Endpoint hỗ trợ các chat completions tiêu chuẩn, giúp dễ dàng tích hợp vào các ứng dụng web hoặc hàm serverless. Dưới đây là cách bạn có thể cấu hình client:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Truyền mảng tin nhắn và ID mô hình uncensored vào hàm completion. Phản hồi sẽ chứa văn bản đã được tạo. Tích hợp này phù hợp cho các nhà phát triển cần nhúng khả năng tạo văn bản không kiểm duyệt vào các ứng dụng Node.js. Bạn hãy đảm bảo xử lý lỗi thích đáng, vì API có thể trả về lỗi giới hạn tốc độ hoặc hết tín dụng.
Phản hồi truyền phát (SSE)
Bật khả năng tạo văn bản theo thời gian thực bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các Sự kiện gửi qua máy chủ (SSE) để phân phối token phản hồi từng token một. Điều này hữu ích cho các giao diện trò chuyện hoặc các ứng dụng nơi độ trễ là yếu tố quan trọng. Bạn hãy sử dụng ví dụ sau để triển khai truyền phát:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Đọc từ luồng khi các token đến. API LLM không kiểm duyệt trực tuyến hỗ trợ điều này một cách bản địa. Truyền phát giảm độ trễ cảm nhận được cho người dùng cuối. Lưu ý rằng truyền phát tiêu tốn cùng số lượng token như các yêu cầu không truyền phát. Mỗi token được tính phí theo số dư tín dụng trả trước của bạn.
Giới hạn tốc độ và Cửa sổ ngữ cảnh
API LLM không kiểm duyệt trực tuyến áp dụng giới hạn 300 yêu cầu mỗi phút trên mỗi khóa. Kích thước thân yêu cầu tối đa là 8 MB. Cửa sổ ngữ cảnh là 100,000 token, bao gồm cả prompt và kết quả. Nếu bạn vượt quá giới hạn tốc độ, API sẽ trả về lỗi 429. Nếu tín dụng trả trước của bạn đã hết, bạn sẽ nhận được lỗi 402. Khóa không hợp lệ hoặc hết hạn sẽ dẫn đến lỗi 401. Những giới hạn này đảm bảo sử dụng công bằng cho tất cả các nhà phát triển. Tín dụng trả trước trả tiền theo mức sử dụng không bao giờ hết hạn, vì vậy bạn có thể sử dụng số dư của mình bất cứ khi nào bạn cần.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredllmonline.com/v1 |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Kích thước yêu cầu | tối đa 8 MB |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Cửa sổ ngữ cảnh là 100,000 token, bao gồm cả prompt đầu vào và kết quả đầu ra. Điều này cho phép xử lý các cuộc hội thoại dài hoặc tài liệu lớn.
Cơ chế tính phí hoạt động như thế nào?
Bạn trả tiền theo mức sử dụng với tín dụng trả trước. Giá là $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra. Tín dụng không bao giờ hết hạn, và bạn có thể nạp tiền bắt đầu từ $10.
Mô hình có giống với GPT-4 không?
Không, ID mô hình là <code>uncensored</code>. Đây là mô hình trọng số mở chạy trên máy chủ GPU của chúng tôi, được tinh chỉnh để trả lời mà không từ chối nội dung. Nó không phải là GPT, Claude hay mô hình của nhà cung cấp khác.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ quá trình thiết lập.