無検閲AIモデルAPIを統合する
無検閲AIモデルAPIキーを取得し、チャット完了エンドポイントを数分で統合してください。base_urlとキーを変更するだけで、即時の拒否なしの応答を提供する当社のそのまま置き換え可能なOpenAI互換APIに切り替えることができます。
認証とベースURL
当社のAPIは、既存のOpenAIクライアントのそのまま置き換え可能な代替として設計されています。変更が必要なのは2つの変数だけです:base_urlとapi_keyです。すべてのリクエストのベースURLはhttps://api.llmmodelsapi.com/v1です。認証はBearerトークンを使用してAuthorizationヘッダーで行われます。APIキーは前払いクレジットへのアクセス権を付与するため、安全に保管してください。ダッシュボードからいつでもキーを再生成でき、古いキーは直ちに無効になります。
最初のリクエスト
接続性をテストするために標準的なチャット完了リクエストを送信してください。モデルID uncensoredを使用して、目的に合わせて構築された大規模言語モデルにアクセスします。このモデルは、法的な成人利用に対してコンテンツ拒否なしで回答するようにチューニングされており、一貫した出力が必要なエージェントに最適です。リクエストボディは標準的なOpenAIチャット完了の形式に従います。
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
応答に有効な完了が含まれていることを確認してください。200ステータスコードが返された場合、統合は正常に機能しています。このai model apiエンドポイントは、コンテキストウィンドウ内で単一ターンおよびマルチターンの会話の両方をサポートしています。
Python SDK統合
公式のOpenAI Python SDKを使用するのが最も迅速な統合方法です。クライアントをベースURLにポイントし、APIキーを提供してください。SDKはシリアライゼーションと接続プールを自動的に処理します。このアプローチは、base_urlのオーバーライドを尊重するすべてのOpenAI互換クライアントライブラリで機能します。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Python SDKはストリーミングと同期呼び出しをサポートしています。ほとんどのエージェントワークフローでは同期呼び出しの方が単純ですが、トークンが生成される際にそれらを表示する必要がある場合はストリーミングを利用できます。SDKのバージョンに関係なく、モデルIDはuncensoredのままです。
Node SDK統合
JavaScriptおよびTypeScript環境では、Node SDKも同じパターンに従います。正しいベースURLと認証情報でクライアントを初期化してください。これにより、既存のコードベースはプロバイダを切り替える際に最小限の変更で済みます。uncensoredモデルIDは、すべての標準的なチャット完了パラメータと互換性があります。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Node SDKはasync/awaitパターンにも対応しており、Expressルーターやサーバーレス関数への統合が容易です。API キーは環境変数に格納し、意図しない公開を防ぎましょう。このopenai compatible api設計により、設定オブジェクトの変更だけでOpenAIに戻ったり、他のプロバイダーに切り替えたりすることが可能です。
ストリーミング応答
リクエストにstream: trueを設定してストリーミングを有効にします。APIはServer-Sent Events (SSE)ストリームを返し、トークンが生成される際に処理することができます。これによりエンドユーザーの知覚されるレイテンシが削減され、リアルタイムのエージェント相互作用に不可欠です。ストリーム形式はOpenAIのSSE仕様と同一です。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
各チャンクには部分的なデルタデータが含まれます。完全な応答を再構築するには、これらのデルタを累積する必要があります。ストリーミングは料金に影響しません。ストリーミングモードに関係なく、合計の入力トークンと出力トークンに対して課金されます。この機能は、当社が提供する堅牢なchat completions api設計の一部です。
制限、エラー、コンテキストウィンドウ
当インフラは信頼性を確保するため厳格な制限を適用しています。キーごとに1分あたり300リクエストまで、リクエストボディの最大サイズは8 MBまでです。コンテキストウィンドウは100,000トークンで、プロンプトと補完で共有されます。レート制限を超えた場合は429エラーが返されます。無効なキーの場合は401、クレジットが不足している場合は402が返されます。多くのllm api providerとは異なり、当社はこれらの制限を隠蔽しません。これらは透明性があり、一貫しています。データへの学習は行わず、プロンプトをモデル改善に使用しないことでプライバシーを維持します。
技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| Base URL | https://api.llmmodelsapi.com/v1 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| JSON モード | response_format: {"type": "json_object"} |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 最大出力 | 64,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| コンテキスト長 | 64,000 トークン(入力+出力) |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| リクエストサイズ | 最大 8 MB |
| レート制限 | キーごとに毎分 300 リクエスト |
| 同時実行 | キーごとに同時 8 リクエストまで |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
これはGPT-4やClaudeと同じモデルですか?
いいえ。当社のモデルは、無検閲な応答に特化してチューニングされたオープンウェイトモデルです。GPT、Claude、Gemini、またはその他のベンダーのモデルではありません。独自のGPUサーバー上で稼働する独立したモデルです。
料金体系はどのように機能しますか?
月額料金なしの従量制前払いクレジットシステムを採用しています。入力トークンは100万トークンあたり$0.25、出力トークンは100万トークンあたり$1.00です。クレジットは期限切れにならず、USDTまたはUSDCによる暗号通貨で$10からチャージできます。
トライアルクレジットとは何ですか?
新規アカウントには7日間有効な$0.50の無料トライアルクレジットが付与されます。開始にクレジットカードや電話番号は不要です。これにより、購入前に<code>uncensored ai model</code>をテストできます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。セットアップはこれだけです。