Uncensored LLM Online API 빠른 시작
이 빠른 시작 가이드를 사용하여 무검열 LLM API를 애플리케이션에 통합하세요. GPU 인프라 관리 없이 표준 OpenAI 호환 엔드포인트를 사용하여 원시 텍스트 생성 요청을 보낼 수 있습니다.
- $0.25
- 입력 토큰 1M당
- $1.00
- 출력 토큰 / 1M
- 100,000
- 토큰 컨텍스트
- $0.50
- 무료 체험 크레딧
- 300
- 분당 요청 수
Base URL 및 인증
무검열 LLM 온라인 API는 표준 OpenAI 호환 엔드포인트를 사용합니다. 클라이언트를 https://api.uncensoredllmonline.com/v1 베이스 URL을 가리키도록 구성하세요. 인증은 Authorization 헤더에 전달되는 API 키를 통해 처리됩니다. 이메일과 비밀번호만으로 API 키 받기 페이지에서 키를 생성할 수 있습니다. 키는 가입 즉시 표시됩니다. 시작하기 위해 전화번호나 신용카드가 필요하지 않습니다. 각 계정에는 하나의 활성 키가 있으며, 이전 키의 접근 권한을 취소하기 위해 언제든지 재생성할 수 있습니다. 키는 선불 크레딧에 직접 접근할 수 있으므로 안전하게 보관하세요.
채팅 완료 엔드포인트
POST /v1/chat/completions로 텍스트를 전송하여 무검열 LLM에 텍스트를 보내세요. 이 엔드포인트는 메시지 목록을 받아 모델의 응답을 반환합니다. 사용할 모델 ID는 uncensored입니다. 이 오픈 웨이트 모델은 합법적인 성인용도로 콘텐츠 거부 없이 답변하도록 조정되었습니다. 이 모델은 GPT, Claude 또는 다른 벤더의 모델이 아닙니다. 이 API는 커스텀 통합에 적합한 원시 텍스트 생성 기능을 반환합니다. 기본 요청을 테스트하려면 다음 cURL 명령어를 사용하세요:
curl https://api.uncensoredllmonline.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
요청 본문에는 모델 ID와 메시지 기록이 포함되어야 합니다. 클라이언트가 Authorization: Bearer <your-key> 헤더를 보내는지 확인하세요. 응답에는 생성된 텍스트가 포함되며, 이를 애플리케이션 로직에서 구문 분석하고 사용할 수 있습니다.
Python SDK 통합
공식 OpenAI Python SDK를 사용하여 무검열 AI 모델과 상호 작용하세요. 클라이언트 초기화 시 base_url 및 api_key을 설정하세요. 이렇게 하면 chat.completions.create과 같은 익숙한 메서드를 사용할 수 있습니다. 다음 예제는 클라이언트를 초기화하고 간단한 쿼리를 보내는 방법을 보여줍니다:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
이 접근 방식은 기존 코드 구조를 활용하면서 무검열 LLM으로 전환할 수 있게 해줍니다. SDK는 JSON 직렬화 및 응답 구문 분석을 자동으로 처리합니다. 올바른 엔드포인트에 접근하려면 모델 ID를 uncensored로 설정해야 합니다. 이 방법은 보일러플레이트 코드를 최소화하려는 개발자에게 이상적입니다.
Node SDK 통합
JavaScript 또는 TypeScript 프로젝트의 경우 OpenAI Node SDK는 당사 API와 원활하게 작동합니다. API 키와 올바른 Base URL을 사용하여 클라이언트를 초기화하세요. 이 엔드포인트는 표준 채팅 완료를 지원하므로 웹 앱이나 서버리스 함수에 쉽게 통합할 수 있습니다. 클라이언트 구성 방법은 다음과 같습니다:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
메시지 배열과 모델 ID uncensored를 완료 함수에 전달하세요. 응답에는 생성된 텍스트가 포함됩니다. 이 통합은 무검열 텍스트 생성을 Node.js 애플리케이션에 임베드해야 하는 개발자에게 적합합니다. API에서 속도 제한이나 크레딧 고갈 오류를 반환할 수 있으므로 적절히 오류를 처리하세요.
스트리밍 응답 (SSE)
요청에 stream: true을 설정하여 실시간 텍스트 생성을 활성화하세요. API는 응답 토큰을 하나씩 전달하는 서버 전송 이벤트(SSE)를 반환합니다. 이는 지연 시간이 중요한 채팅 인터페이스나 애플리케이션에 유용합니다. 스트리밍을 구현하려면 다음 예제를 사용하세요:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
토큰이 도착하는 대로 스트림에서 읽으세요. 무검열 LLM API는 이를 기본적으로 지원합니다. 스트리밍은 최종 사용자에게 인식되는 지연 시간을 줄여줍니다. 스트리밍은 비스트리밍 요청과 동일한 토큰 수를 소비한다는 점을 유의하세요. 각 토큰은 선불 크레딧 잔액에 따라 청구됩니다.
속도 제한 및 컨텍스트 창
무검열 LLM API는 키당 분당 300개의 요청 제한을 적용합니다. 최대 요청 본문 크기는 8 MB입니다. 컨텍스트 창은 프롬프트와 완료를 모두 포함하여 100,000 토큰입니다. 속도 제한을 초과하면 API가 429 오류를 반환합니다. 선불 크레딧이 고갈되면 402 오류가 발생합니다. 유효하지 않거나 만료된 키의 경우 401 오류가 발생합니다. 이러한 제한은 모든 개발자에게 공정한 사용을 보장합니다. 종량제 선불 크레딧은 만료되지 않으므로 필요할 때 언제든지 잔액을 사용할 수 있습니다.
API 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 모델 ID | uncensored |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredllmonline.com/v1 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON 모드 | response_format: {"type": "json_object"} |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 요청 크기 | 최대 8 MB |
| 동시 요청 | 키당 동시 8개 |
| 속도 제한 | 키당 분당 300회 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
컨텍스트 창 크기는 얼마인가요?
컨텍스트 창은 입력 프롬프트와 출력 완료 텍스트를 모두 포함하여 100,000 토큰입니다. 이는 긴 대화나 대규모 문서 처리를 가능하게 합니다.
청구 방식은 어떻게 되나요?
선불 크레딧을 사용한 종량제 요금제를 이용합니다. 입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00입니다. 크레딧은 만료되지 않으며, $10부터 충전할 수 있습니다.
모델이 GPT-4와 동일한가요?
아니요, 모델 ID는 <code>uncensored</code>입니다. 이 오픈 웨이트 모델은 자체 GPU 서버에서 실행되며 콘텐츠 거부 없이 답변하도록 조정되었습니다. GPT, Claude 또는 기타 벤더의 모델이 아닙니다.