Uncensored LLM Online API クイックスタート
このクイックスタートガイドで、無検閲LLMオンラインAPIをアプリケーションに統合しましょう。GPUインフラストラクチャの管理なしで、標準のOpenAI互換エンドポイントを使用して、生でフィルタリングされていないテキスト生成リクエストを送信します。
- $0.25
- 入力トークン1Mあたり
- $1.00
- 出力トークン / 1M
- 100,000
- トークンコンテキスト
- $0.50
- 無料トライアルクレジット
- 300
- 1分あたりのリクエスト数
Base URLと認証
無検閲LLMオンラインAPIは標準のOpenAI互換エンドポイントを使用します。クライアントをベースURL https://api.uncensoredllmonline.com/v1 に設定してください。認証は Authorization ヘッダーに渡すAPIキーによって行われます。メールアドレスとパスワードのみを使用して APIキーの取得 ページでキーを生成できます。キーはサインアップ直後に表示されます。電話番号やクレジットカードは必要ありません。各アカウントには有効なキーが1つあり、古いキーのアクセスを取り消すためにいつでも再生成できます。キーは前払いクレジットへの直接アクセスを提供するため、安全に保管してください。
チャット補完エンドポイント
POST /v1/chat/completions へのPOSTリクエストで無検閲LLMにテキストを送信します。このエンドポイントはメッセージのリストを受け取り、モデルのレスポンスを返します。使用するモデルIDは uncensored です。これは、法的な成人用途のためにコンテンツ拒否なしで回答するように調整されたオープンプウェイトモデルです。GPT、Claude、または他のベンダーのモデルではありません。APIはカスタム統合に適した生のテキスト生成機能を提供します。基本的なリクエストをテストするには、次のcURLコマンドを使用してください:
curl https://api.uncensoredllmonline.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
リクエストボディにはモデルIDとメッセージ履歴を含める必要があります。クライアントが Authorization: Bearer <your-key> ヘッダーを送信していることを確認してください。レスポンスには生成されたテキストが含まれ、これをアプリケーションロジックで解析して使用できます。
Python SDK統合
公式のOpenAI Python SDKを使用して無検閲AIモデルと対話します。クライアント初期化時に base_url と api_key を設定します。これにより、chat.completions.create などの馴染みのあるメソッドを使用できます。次の例は、クライアントの初期化と簡単なクエリの送信方法を示しています:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredllmonline.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
このアプローチにより、既存のコード構造を活用しながら無検閲LLMに切り替えることができます。SDKはJSONシリアライゼーションとレスポンス解析を自動的に処理します。正しいエンドポイントにアクセスするためにモデルIDを uncensored に設定する必要があることを忘れないでください。この方法は、ボイラープレートコードを最小限に抑えたい開発者に最適です。
Node SDK統合
JavaScriptまたはTypeScriptプロジェクトの場合、OpenAI Node SDKはAPIとシームレスに連携します。APIキーと正しいBase URLを使用してクライアントを初期化してください。エンドポイントは標準のチャット完了をサポートしており、Webアプリやサーバーレス関数への統合が容易です。クライアントの設定方法は次の通りです:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredllmonline.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
メッセージ配列とモデルID uncensored を完了関数に渡します。レスポンスには生成されたテキストが含まれます。この統合は、Node.jsアプリケーションに無検閲テキスト生成を埋め込む必要がある開発者に適しています。APIがレート制限やクレジット枯渇のエラーを返す可能性があるため、エラーを適切に処理してください。
ストリーミングレスポンス(SSE)
リクエストに stream: true を設定して、リアルタイムのテキスト生成を有効にします。APIはサーバーサイドイベント(SSE)を返し、レスポンスをトークン単位で配信します。これは、チャットインターフェースやレイテンシが重要なアプリケーションに役立ちます。ストリーミングの実装には次の例を使用してください:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
トークンが到着するたびにストリームから読み取ります。無検閲LLM APIはこれをネイティブにサポートしています。ストリーミングはエンドユーザーにとっての知覚レイテンシを削減します。ストリーミングはストリーミング以外のリクエストと同じトークン数を消費することに注意してください。各トークンは前払いクレジット残高に応じて請求されます。
レート制限とコンテキストウィンドウ
無検閲LLM APIは、キーごとに1分あたり300リクエストの制限を課します。最大リクエストボディサイズは8 MBです。コンテキストウィンドウは100,000トークンで、プロンプトと完了の両方をカバーします。レート制限を超えた場合、APIは429エラーを返します。前払いクレジットが枯渇した場合は、402エラーが発生します。無効または期限切れのキーの場合、401エラーが発生します。これらの制限は、すべての開発者間で公平な使用を保証します。従量課金制の前払いクレジットは期限切れにならないため、必要に応じて残高を使用できます。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredllmonline.com/v1 |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| JSON モード | response_format: {"type": "json_object"} |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レート制限 | キーごとに毎分 300 リクエスト |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
コンテキストウィンドウのサイズは?
コンテキストウィンドウは100,000トークンで、入力プロンプトと出力完了の両方を含みます。これにより、長い会話や大規模なドキュメント処理が可能です。
請求はどのように機能しますか?
前払いクレジットで従量課金制です。料金は入力トークン1Mあたり$0.25、出力トークン1Mあたり$1.00です。クレジットは期限切れにならず、$10からチャージできます。
モデルはGPT-4と同じですか?
いいえ、モデルIDは<code>uncensored</code>です。これは独自のGPUサーバーで実行されるオープンプウェイトモデルで、コンテンツ拒否なしで回答するように調整されています。GPT、Claude、または他のベンダーのモデルではありません。