Uncensored Local LLM API を統合する
OpenAI 互換クライアントをホストされたエンドポイントに接続して Uncensored Local LLM API を統合します。ローカル GPU インフラストラクチャの管理が不要で、100k コンテキストウィンドウ、ストリーミングサポート、生モデル出力が得られます。
- ベース URL
- https://api.uncensoredlocalllm.com/v1
- モデル
- 無検閲
Base URL と認証
当社のAPIはOpenAI SDKと完全に互換性があります。base_urlを更新し、API キーを入力するだけです。API キーを取得ページで登録すると、キーをすぐに入手できます。無料トライアルクレジットを開始するために電話番号やクレジットカードは必要ありません。ベースURLはhttps://api.uncensoredlocalllm.com/v1です。キーは安全に保管してください。いつでも再生成でき、古いキーは即時無効になります。これにより、ローカル推論管理の複雑さなしに、アプリケーションに単一で安定したエンドポイントを提供し続けます。
最初のリクエスト
お好みの HTTP クライアントを使用して最初の API コールを行います。エンドポイントは標準の chat-completions 形式をサポートします。以下は基本的なリクエストを示す cURL の例です。YOUR_API_KEY を実際のキーに置き換えてください。このリクエストはプロンプトを送信し、テキスト応答を期待します。モデル ID は uncensored です。このオープンウェイトモデルは、法的な成人用途に対してコンテンツ拒否なしで回答するようにチューニングされており、ユースケースに合わせた直接の出力を提供します。
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
レスポンスにはchoices配列に生成されたテキストが含まれます。401エラーが発生した場合は、API キーが無効または未入力です。正しいBase URLを使用し、再生成後にキーが無効化されていないことを確認してください。
Python SDK 統合
公式のOpenAI Python SDKを使用して迅速に統合します。クライアント初期化時にbase_urlとapi_keyを設定してください。この方法により、chat.completions.create()などの馴染みのあるメソッドを使用できます。SDKはJSONシリアライズとHTTPリクエストを自動的に処理します。これは大量のテキストを処理する必要があるバックエンドサービスやスクリプトに最適です。使用するSDKのバージョンに関係なく、モデルIDは常にuncensoredであることを忘れないでください。
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
この方法はバッチ処理に適しており、Python で応答ロジックを処理する必要がある場合に有用です。環境に openai パッケージがインストールされていることを確認してください。SDK は同期および非同期の両方の操作をサポートしており、さまざまなアーキテクチャのニーズに対応します。
Node SDK 統合
JavaScript または TypeScript 環境では、OpenAI Node SDK が同様の体験を提供します。Base URL と API キーを使用してクライアントを初期化します。これは Web アプリケーションやサーバーレス関数に特に有用です。SDK は HTTP の詳細を抽象化し、アプリケーションロジックに集中できるようにします。他の OpenAI 互換サービスと同じ構造で完了エンドポイントを呼び出すことができます。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
この統合はリアルタイムの Web インターフェースや Node.js マイクロサービスに使用します。SDK はプロミスと async/await パターンをサポートしており、エラー処理が容易です。分散システムでは特に、ネットワークエラーを適切に処理してください。
ストリーミングレスポンス
リクエストに stream: true を設定してストリーミングを有効にします。これにより、生成されるたびに部分的な応答を受信でき、ユーザーにとっての知覚レイテンシが改善されます。API はストリーミングのために Server-Sent Events (SSE) をサポートします。即時フィードバックが期待されるチャットインターフェースではこれが重要です。ストリーミングはモデルの出力品質やコンテキストウィンドウに影響しません。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
クライアントコードでストリームイベントを処理します。各チャンクは最終応答の一部を含みます。これらのチャンクを結合して完全なメッセージを再構築します。このアプローチは Python および Node.js の OpenAI SDK とシームレスに動作します。
レート制限、エラー、およびコンテキストウィンドウ
API はキーあたり 1 分あたり 300 リクエストの制限を適用します。最大リクエストボディサイズは 8 MB です。レート制限を超えると 429 エラーが発生します。402 エラーは前払いクレジットが不足していることを示します。ダッシュボードを通じて使用状況を監視し、アカウントにチャージしてください。クレジットは期限切れにならず、暗号通貨(USDT または USDC)で支払うことができます。
コンテキストウィンドウは 100,000 トークンで、プロンプトと補完の両方をカバーします。これにより、長時間の会話や大規模なドキュメントの処理が可能です。制限を超えると、API はリクエストを拒否します。モデル ID は uncensored で、拡張機能のためにツール/関数呼び出しをサポートします。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| モデル ID | uncensored |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| JSON モード | response_format: {"type": "json_object"} |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| リクエストサイズ | 最大 8 MB |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レート制限 | キーごとに毎分 300 リクエスト |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
コンテキストウィンドウのサイズは?
API は入力プロンプトと出力補完を含む 100,000 トークンのコンテキストウィンドウをサポートします。これにより、単一のリクエストで長時間の会話や大規模なドキュメントの処理が可能です。
ストリーミングレスポンスはどのように処理しますか?
リクエストに <code>stream: true</code> を設定して Server-Sent Events (SSE) を受信します。Python および Node.js の OpenAI SDK は、このフラグを有効にするとストリーミングを自動的に処理します。その後、到着するたびに各チャンクを処理できます。
クレジットが不足した場合どうなりますか?
クレジットが利用できないことを示す <code>402</code> エラーが発生します。暗号通貨(USDT または USDC)を使用して、最低 $10 からアカウントにチャージできます。クレジットは期限切れにならず、大口チャージにはボーナスが適用されます。