ES ▾
Obtener clave de API

Inicio rápido de la API de Uncensored LLM Online

Integra la API del LLM sin censura en línea en tu aplicación con esta guía de inicio rápido. Usa endpoints compatibles con OpenAI para enviar solicitudes de generación de texto sin filtrar sin gestionar la infraestructura GPU.

$0,25
por cada 1M de tokens de entrada
$1,00
Tokens de salida / 1M
100.000
contexto de tokens
$0,50
crédito de prueba
300
peticiones por minuto

URL base y autenticación

La API del LLM sin censura en línea utiliza endpoints compatibles con OpenAI. Configura tu cliente para que apunte a la URL base https://api.uncensoredllmonline.com/v1. La autenticación se maneja mediante una clave de API pasada en el encabezado Authorization. Puedes generar tu clave en la página Obtener clave de API usando solo un correo electrónico y una contraseña. La clave se muestra inmediatamente después del registro. No se requiere número de teléfono ni tarjeta de crédito para comenzar. Cada cuenta tiene una clave activa, que se puede regenerar en cualquier momento para revocar el acceso de la clave anterior. Mantén tu clave segura, ya que proporciona acceso directo a tus créditos prepago.

Endpoint de chat completions

Envía texto al LLM sin censura publicando en POST /v1/chat/completions. Este endpoint acepta una lista de mensajes y devuelve la respuesta del modelo. El ID del modelo a usar es uncensored. Es un modelo de pesos abiertos ajustado para responder sin rechazos de contenido para uso adulto legal. No es GPT, Claude ni el modelo de otro proveedor. La API devuelve capacidades de generación de texto sin filtrar adecuadas para integraciones personalizadas. Usa el siguiente comando cURL para probar una solicitud básica:

curl https://api.uncensoredllmonline.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

El cuerpo de la petición debe incluir el ID del modelo y el historial de mensajes. Asegúrate de que tu cliente envíe el encabezado Authorization: Bearer <your-key>. La respuesta contendrá el texto generado, que puedes analizar y usar en la lógica de tu aplicación.

Integración con SDK de Python

Usa el SDK oficial de OpenAI para Python para interactuar con el modelo de IA sin censura. Establece el base_url y el api_key en la inicialización de tu cliente. Esto te permite usar métodos familiares como chat.completions.create. El siguiente ejemplo demuestra cómo inicializar el cliente y enviar una consulta simple:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Este enfoque te permite aprovechar las estructuras de código existentes mientras cambias a un LLM sin censura. El SDK maneja la serialización JSON y el análisis de respuestas automáticamente. Recuerda que el ID del modelo debe establecerse en uncensored para asegurarte de que estás alcanzando el endpoint correcto. Este método es ideal para desarrolladores que desean minimizar el código repetitivo.

Integración con SDK de Node.js

Para proyectos en JavaScript o TypeScript, el SDK de Node.js de OpenAI funciona perfectamente con nuestra API. Inicializa el cliente con tu clave de API y la URL base correcta. El endpoint admite chat completions estándar, lo que facilita la integración en aplicaciones web o funciones sin servidor. Así es como puedes configurar el cliente:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Pasa el array de mensajes y el ID del modelo uncensored a la función de completación. La respuesta contendrá el texto generado. Esta integración es adecuada para desarrolladores que necesitan incrustar la generación de texto sin censura en aplicaciones Node.js. Asegúrate de manejar los errores apropiadamente, ya que la API puede devolver errores de límite de peticiones o agotamiento de créditos.

Respuestas en streaming (SSE)

Habilita la generación de texto en tiempo real estableciendo stream: true en tu solicitud. La API devuelve Server-Sent Events (SSE) que entregan el token de respuesta token por token. Esto es útil para interfaces de chat o aplicaciones donde la latencia es importante. Usa el siguiente ejemplo para implementar streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lee del stream a medida que llegan los tokens. La API del LLM sin censura en línea admite esto de forma nativa. El streaming reduce la latencia percibida para los usuarios finales. Ten en cuenta que el streaming consume la misma cantidad de tokens que las solicitudes no en streaming. Cada token se factura según tu saldo de crédito prepago.

Límites de peticiones y ventana de contexto

La API del LLM sin censura en línea aplica un límite de 300 peticiones por minuto por clave. El tamaño máximo del cuerpo de la solicitud es de 8 MB. La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la completación. Si excedes el límite de peticiones, la API devuelve un error 429. Si tu crédito prepago se agota, recibes un error 402. Una clave inválida o expirada resulta en un error 401. Estos límites garantizan un uso justo para todos los desarrolladores. El crédito prepago de pago por uso no caduca, así que puedes usar tu saldo cuando lo necesites.

Funciones y límites

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
AutenticaciónAuthorization: Bearer YOUR_KEY
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.uncensoredllmonline.com/v1
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Ventana de contexto100.000 tokens (entrada + salida)
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Modo JSONresponse_format: {"type": "json_object"}
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamaño de peticiónhasta 8 MB
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Caducidadel crédito pagado no caduca, sin suscripción
Bono+5 % desde $50, +10 % desde $100
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es el tamaño de la ventana de contexto?

La ventana de contexto es de 100.000 tokens, lo que incluye tanto el prompt de entrada como la completación de salida. Esto permite conversaciones largas o el procesamiento de documentos grandes.

¿Cómo funciona la facturación?

Pagas por uso con crédito prepago. La tarifa es de $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida. Los créditos no caducan y puedes recargar a partir de $10.

¿Es el modelo el mismo que GPT-4?

No, el ID del modelo es <code>uncensored</code>. Es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU, ajustado para responder sin rechazos de contenido. No es GPT, Claude ni el modelo de ningún otro proveedor.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API