DE ▾
API-Schlüssel erhalten

Uncensored LLM Online API Schnellstart

Integriere die unzensierte LLM Online API in deine Anwendung mit dieser Schnellstartanleitung. Nutze standard OpenAI-kompatible Endpunkte, um rohe, unfilterierte Textgenerierungsanfragen zu senden, ohne GPU-Infrastruktur verwalten zu müssen.

$0,25
pro 1M Input-Token
$1,00
Output-Token / 1M
100.000
Token-Kontext
$0,50
Testguthaben
300
Anfragen pro Minute

Base URL und Authentifizierung

Die unzensierte LLM-Online-API verwendet Standard-Endpunkte, die mit OpenAI kompatibel sind. Konfiguriere deinen Client so, dass er auf die Basis-URL https://api.uncensoredllmonline.com/v1 zeigt. Die Authentifizierung erfolgt über einen API-Schlüssel, der im Authorization-Header übergeben wird. Du kannst deinen Schlüssel auf der Seite API-Schlüssel abrufen generieren, indem du nur E-Mail und Passwort angibst. Der Schlüssel wird direkt nach der Anmeldung angezeigt. Für den Einstieg werden keine Telefonnummer oder Kreditkarte benötigt. Jedes Konto verfügt über einen aktiven Schlüssel, der jederzeit neu generiert werden kann, um den Zugriff des alten Schlüssels zu widerrufen. Bewahre deinen Schlüssel sicher auf, da er direkten Zugriff auf dein Prepaid-Guthaben gewährt.

Chat Completions Endpunkt

Sende Text an die uncensored llm, indem du eine Anfrage an POST /v1/chat/completions sendest. Dieser Endpunkt akzeptiert eine Liste von Nachrichten und gibt die Antwort des Modells zurück. Die zu verwendende Modell-ID ist uncensored. Dies ist ein Open-Weight-Modell, das darauf abgestimmt ist, ohne Inhaltsfilter für die rechtmäßige Nutzung durch Erwachsene zu antworten. Es ist kein GPT, Claude oder ein Modell eines anderen Anbieters. Die API bietet rohe Textgenerierungsfähigkeiten, die sich für benutzerdefinierte Integrationen eignen. Verwende den folgenden cURL-Befehl, um eine einfache Anfrage zu testen:

curl https://api.uncensoredllmonline.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Der Anfragekörper sollte die Modell-ID und deinen Nachrichtenverlauf enthalten. Stelle sicher, dass dein Client den Authorization: Bearer <your-key>-Header sendet. Die Antwort enthält den generierten Text, den du in deiner Anwendungslogik analysieren und verwenden kannst.

Python SDK Integration

Verwende das offizielle OpenAI Python SDK, um mit dem unzensierten KI-Modell zu interagieren. Setze die base_url und api_key bei der Client-Initialisierung. Dies ermöglicht dir, vertraute Methoden wie chat.completions.create zu nutzen. Das folgende Beispiel zeigt, wie du den Client initialisierst und eine einfache Abfrage sendest:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Dieser Ansatz ermöglicht es dir, bestehende Code-Strukturen zu nutzen, während du zu einem unzensierten LLM wechselst. Das SDK übernimmt die JSON-Serialisierung und Antwortanalyse automatisch. Denke daran, dass die Modell-ID auf uncensored gesetzt werden muss, um sicherzustellen, dass du den richtigen Endpunkt triffst. Diese Methode ist ideal für Entwickler, die Boilerplate-Code minimieren möchten.

Node SDK Integration

Für JavaScript- oder TypeScript-Projekte funktioniert das OpenAI Node SDK nahtlos mit unserer API. Initialisiere den Client mit deinem API-Schlüssel und der korrekten Base URL. Der Endpunkt unterstützt standardmäßige Chat Completions, was die Integration in Web-Apps oder serverlose Funktionen einfach macht. So konfigurierst du den Client:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Übergib das Nachrichten-Array und die Modell-ID uncensored an die Completion-Funktion. Die Antwort enthält den generierten Text. Diese Integration eignet sich für Entwickler, die unzensierte Textgenerierung in Node.js-Anwendungen einbetten möchten. Stelle sicher, dass du Fehler angemessen behandelst, da die API Ratenlimit- oder Guthabe-Erschöpfung-Fehler zurückgeben kann.

Streaming-Antworten (SSE)

Aktiviere die Echtzeit-Textgenerierung, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück, die die Antwort Token für Token liefern. Dies ist nützlich für Chat-Schnittstellen oder Anwendungen, bei denen Latenz eine Rolle spielt. Verwende das folgende Beispiel, um Streaming zu implementieren:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lese vom Stream, während Tokens eintreffen. Die unzensierte LLM Online API unterstützt dies nativ. Streaming reduziert die wahrgenommene Latenz für Endbenutzer. Beachte, dass Streaming dieselbe Token-Anzahl verbraucht wie nicht-streaming Anfragen. Jeder Token wird gemäß deinem Prepaid-Guthaben berechnet.

Ratenlimits und Kontextfenster

Die unzensierte LLM Online API erzwingt ein Limit von 300 Anfragen pro Minute pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster umfasst 100.000 Token, sowohl Prompt als auch Vervollständigung. Wenn du das Ratenlimit überschreitest, gibt die API einen 429-Fehler zurück. Wenn dein Prepaid-Guthaben erschöpft ist, erhältst du einen 402-Fehler. Ein ungültiger oder abgelaufener Schlüssel führt zu einem 401-Fehler. Diese Limits gewährleisten eine faire Nutzung für alle Entwickler. Pay as you go Prepaid-Guthaben verfällt nie, sodass du dein Guthaben nutzen kannst, wann immer du es brauchst.

Fragen und Antworten

Wie groß ist das Kontextfenster?

Das Kontextfenster umfasst 100.000 Token, sowohl den Eingabe-Prompt als auch die Ausgabe-Vervollständigung. Dies ermöglicht lange Gespräche oder die Verarbeitung großer Dokumente.

Wie funktioniert die Abrechnung?

Du zahlst Pay as you go mit Prepaid-Guthaben. Der Preis beträgt $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Guthaben verfällt nie, und du kannst ab $10 aufladen.

Ist das Modell dasselbe wie GPT-4?

Nein, die Modell-ID ist <code>uncensored</code>. Es ist ein Open-Weight-Modell, das auf unseren eigenen GPU-Servern läuft und darauf abgestimmt ist, ohne Inhaltsfilter zu antworten. Es ist kein GPT, Claude oder ein Modell eines anderen Anbieters.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.uncensoredllmonline.com/v1
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
JSON-Modusresponse_format: {"type": "json_object"}
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Bonus+5 % ab $50, +10 % ab $100
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen