Início rápido da API Uncensored LLM Online
Integre a API de LLM sem censura online ao seu aplicativo com este guia de início rápido. Use endpoints padrão compatíveis com OpenAI para enviar solicitações de geração de texto bruto e sem filtros, sem gerenciar infraestrutura de GPU.
- $0.25
- por 1M de tokens de entrada
- $1.00
- Tokens de saída / 1M
- 100,000
- contexto de tokens
- $0.50
- crédito de teste
- 300
- requisições por minuto
URL base e autenticação
A API da LLM sem censura online usa endpoints padrão compatíveis com OpenAI. Configure seu cliente para apontar para a URL base https://api.uncensoredllmonline.com/v1. A autenticação é feita por meio de uma chave de API passada no cabeçalho Authorization. Você pode gerar sua chave na página Obter chave de API usando apenas e-mail e senha. A chave é exibida imediatamente após o cadastro. Não é necessário número de telefone ou cartão de crédito para começar. Cada conta possui uma chave ativa, que pode ser regenerada a qualquer momento para revogar o acesso da chave antiga. Mantenha sua chave segura, pois ela fornece acesso direto aos seus créditos pré-pagos.
Endpoint de Chat Completions
Envie texto para a LLM sem censura postando em POST /v1/chat/completions. Este endpoint aceita uma lista de mensagens e retorna a resposta do modelo. O ID do modelo a ser usado é uncensored. Este é um modelo de pesos abertos ajustado para responder sem recusas de conteúdo para uso adulto lícito. Não é GPT, Claude ou o modelo de outro fornecedor. A API retorna capacidades de geração de texto bruto adequadas para integrações personalizadas. Use o seguinte comando cURL para testar uma solicitação básica:
curl https://api.uncensoredllmonline.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
O corpo da requisição deve incluir o ID do modelo e o histórico de mensagens. Certifique-se de que seu cliente envie o cabeçalho Authorization: Bearer <your-key>. A resposta conterá o texto gerado, que você pode analisar e usar na lógica da sua aplicação.
Integração com SDK Python
Use o SDK Python oficial da OpenAI para interagir com o modelo de IA sem censura. Defina o base_url e o api_key na inicialização do seu cliente. Isso permite que você use métodos familiares como chat.completions.create. O exemplo a seguir demonstra como inicializar o cliente e enviar uma consulta simples:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Essa abordagem permite que você aproveite estruturas de código existentes enquanto muda para uma LLM sem censura. O SDK lida com a serialização JSON e a análise de resposta automaticamente. Lembre-se de que o ID do modelo deve ser definido como uncensored para garantir que você esteja atingindo o endpoint correto. Este método é ideal para desenvolvedores que desejam minimizar o código boilerplate.
Integração com SDK Node.js
Para projetos JavaScript ou TypeScript, o SDK Node.js da OpenAI funciona perfeitamente com nossa API. Inicialize o cliente com sua chave de API e a URL base correta. O endpoint suporta chat completions padrão, facilitando a integração em aplicativos web ou funções serverless. Veja como configurar o cliente:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Passe o array de mensagens e o ID do modelo uncensored para a função de conclusão. A resposta conterá o texto gerado. Esta integração é adequada para desenvolvedores que precisam incorporar geração de texto sem censura em aplicativos Node.js. Certifique-se de tratar erros adequadamente, pois a API pode retornar erros de limite de requisições ou exaustão de crédito.
Respostas em streaming (SSE)
Ative a geração de texto em tempo real definindo stream: true na sua solicitação. A API retorna Eventos Enviados pelo Servidor (SSE) que entregam o token de resposta token por token. Isso é útil para interfaces de chat ou aplicativos onde a latência é crítica. Use o exemplo a seguir para implementar o streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Leia do stream conforme os tokens chegam. A API de LLM sem censura online suporta isso nativamente. O streaming reduz a latência percebida para os usuários finais. Observe que o streaming consome a mesma contagem de tokens que as solicitações sem streaming. Cada token é cobrado de acordo com o saldo do seu crédito pré-pago.
Limites de taxa e janela de contexto
A API da LLM sem censura online impõe um limite de 300 requisições por minuto por chave. O tamanho máximo do corpo da solicitação é 8 MB. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Se você exceder o limite de requisições, a API retornará um erro 429. Se seu crédito pré-pago for esgotado, você receberá um erro 402. Uma chave inválida ou expirada resulta em um erro 401. Esses limites garantem o uso justo por todos os desenvolvedores. O crédito pré-pago pagamento por uso nunca expira, então você pode usar seu saldo sempre que precisar.
Recursos e limites
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredllmonline.com/v1 |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Limite de taxa | 300 requisições por minuto por chave |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Validade | crédito pago não expira, sem assinatura |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Qual o tamanho da janela de contexto?
A janela de contexto é de 100.000 tokens, incluindo o prompt de entrada e a conclusão de saída. Isso permite conversas longas ou processamento de documentos grandes.
Como funciona a cobrança?
Você paga conforme o uso com crédito pré-pago. A tarifa é $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Créditos nunca expiram e você pode recarregar a partir de $10.
O modelo é o mesmo que o GPT-4?
Não, o ID do modelo é <code>uncensored</code>. É um modelo de pesos abertos executado em nossos próprios servidores GPU, ajustado para responder sem recusas de conteúdo. Não é GPT, Claude ou modelo de outro fornecedor.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.