Guida rapida API Uncensored LLM Online
Integra l'API del LLM senza censura online nella tua applicazione con questa guida rapida. Usa endpoint standard compatibili con OpenAI per inviare richieste di generazione di testo grezzo e senza filtri senza gestire l'infrastruttura GPU.
- $0,25
- per 1M di token di input
- $1,00
- Token di output / 1M
- 100.000
- contesto token
- $0,50
- credito di prova gratuito
- 300
- richieste al minuto
URL base e autenticazione
L'API uncensored llm online utilizza endpoint standard compatibili con OpenAI. Configura il tuo client per puntare all'URL di base https://api.uncensoredllmonline.com/v1. L'autenticazione avviene tramite una chiave API passata nell'intestazione Authorization. Puoi generare la tua chiave nella pagina Ottieni chiave API usando solo email e password. La chiave viene visualizzata immediatamente al momento della registrazione. Non sono necessari numero di telefono o carta di credito per iniziare. Ogni account contiene una chiave attiva, che può essere rigenerata in qualsiasi momento per revocare l'accesso alla vecchia chiave. Mantieni la chiave al sicuro, poiché fornisce accesso diretto ai tuoi crediti prepagati.
Endpoint Chat Completions
Invia testo all'uncensored llm effettuando una richiesta POST a POST /v1/chat/completions. Questo endpoint accetta un elenco di messaggi e restituisce la risposta del modello. L'ID del modello da utilizzare è uncensored. Si tratta di un modello a pesi aperti ottimizzato per rispondere senza rifiuti di contenuto per uso adulto lecito. Non è GPT, Claude o un modello di un altro fornitore. L'API restituisce capacità di generazione di testo grezzo adatte a integrazioni personalizzate. Usa il seguente comando cURL per testare una richiesta di base:
curl https://api.uncensoredllmonline.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Il corpo della richiesta deve includere l'ID del modello e la cronologia dei messaggi. Assicurati che il tuo client invii l'intestazione Authorization: Bearer <your-key>. La risposta conterrà il testo generato, che puoi analizzare e utilizzare nella logica della tua applicazione.
Integrazione SDK Python
Usa l'SDK Python ufficiale di OpenAI per interagire con il modello AI senza censura. Imposta base_url e api_key nell'inizializzazione del tuo client. Questo ti permette di usare metodi familiari come chat.completions.create. L'esempio seguente mostra come inizializzare il client e inviare una query semplice:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Questo approccio ti permette di sfruttare le strutture di codice esistenti passando a un LLM senza censura. L'SDK gestisce automaticamente la serializzazione JSON e l'analisi delle risposte. Ricorda che l'ID del modello deve essere impostato su uncensored per assicurarti di raggiungere l'endpoint corretto. Questo metodo è ideale per gli sviluppatori che vogliono minimizzare il codice ridondante.
Integrazione SDK Node.js
Per progetti JavaScript o TypeScript, l'SDK Node.js di OpenAI funziona perfettamente con la nostra API. Inizializza il client con la tua chiave API e l'URL base corretto. L'endpoint supporta le chat completions standard, rendendo facile l'integrazione in app web o funzioni serverless. Ecco come configurare il client:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Passa l'array di messaggi e l'ID del modello uncensored alla funzione di completamento. La risposta conterrà il testo generato. Questa integrazione è adatta per gli sviluppatori che devono incorporare la generazione di testo senza censura nelle applicazioni Node.js. Assicurati di gestire gli errori in modo appropriato, poiché l'API potrebbe restituire errori di limite di richiesta o esaurimento del credito.
Risposte in streaming (SSE)
Abilita la generazione di testo in tempo reale impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) che consegnano il token risposta token per token. Questo è utile per interfacce chat o applicazioni dove la latenza è cruciale. Usa il seguente esempio per implementare lo streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Leggi dallo stream man mano che arrivano i token. L'API del LLM senza censura online supporta questa funzionalità nativamente. Lo streaming riduce la latenza percepita per gli utenti finali. Tieni presente che lo streaming consuma lo stesso numero di token delle richieste non in streaming. Ogni token viene fatturato in base al saldo del tuo credito prepagato.
Limiti di richiesta e finestra di contesto
L'API uncensored llm online impone un limite di 300 richieste al minuto per chiave. La dimensione massima del corpo della richiesta è di 8 MB. La finestra di contesto è di 100.000 token, che coprono sia il prompt che il completamento. Se superi il limite di richieste, l'API restituisce un errore 429. Se il tuo credito prepagato si esaurisce, ricevi un errore 402. Una chiave non valida o scaduta provoca un errore 401. Questi limiti garantiscono un utilizzo equo per tutti gli sviluppatori. Il credito prepagato pagamento a consumo non scade mai, quindi puoi utilizzare il tuo saldo quando ne hai bisogno.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredllmonline.com/v1 |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Finestra di contesto | 100.000 token (input + output) |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modalità JSON | response_format: {"type": "json_object"} |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Dimensione | fino a 8 MB per richiesta |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Bonus | +5% da $50, +10% da $100 |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 100.000 token, che includono sia il prompt di input che il completamento di output. Questo permette conversazioni lunghe o l'elaborazione di documenti di grandi dimensioni.
Come funziona la fatturazione?
Paghi a consumo con credito prepagato. Il prezzo è di $0,25 per 1M di token di input e $1,00 per 1M di token di output. I crediti non scadono mai e puoi ricaricare a partire da $10.
Il modello è lo stesso di GPT-4?
No, l'ID del modello è <code>uncensored</code>. È un modello a pesi aperti eseguito sui nostri server GPU, ottimizzato per rispondere senza rifiuti sui contenuti. Non è GPT, Claude o il modello di nessun altro fornitore.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.