整合無審查 AI 模型 API
取得你的無審查 AI 模型 API 金鑰,並在幾分鐘內整合聊天完成端點。變更你的 base_url 和金鑰即可切換至我們相容 OpenAI 的 API,立即獲得無拒絕的回應。
認證與基礎 URL
我們的 API 設計為現有 OpenAI 客戶端的即插即用替代品。你只需更改兩個變數:base_url 和你的 api_key。所有請求的基礎 URL 為 https://api.llmmodelsapi.com/v1。驗證透過 Authorization 標頭使用 Bearer token 處理。請確保你的 API 金鑰安全,因為它可存取你的預付額度。你可隨時從儀表板重新產生金鑰,這會立即使舊金鑰失效。
首次請求
發送標準聊天補全請求以測試連線。使用模型 ID uncensored 來存取我們專門設計的大型語言模型。該模型經過微調,可在合法成人用途下無內容拒絕地回答,非常適合需要一致輸出的代理程式。請求主體遵循標準 OpenAI 聊天補全格式。
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
驗證回應是否包含有效的補全內容。如果您收到 200 狀態碼,表示您的整合運作正常。此 ai model api 端點支援上下文視窗內的單輪和多輪對話。
Python SDK 整合
使用官方 OpenAI Python SDK 是整合的最快方式。將客戶端指向我們的基礎 URL 並提供您的 API 金鑰。SDK 會自動處理序列化與連線池。此方法適用於任何尊重 base_url 覆蓋的 OpenAI 相容客戶端函式庫。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Python SDK 支援串流和同步呼叫。對於大多數代理工作流程,同步呼叫較為簡單,但如果您需要顯示生成中的 token,則可使用串流。無論 SDK 版本為何,模型 ID 均為 uncensored。
Node SDK 整合
對於 JavaScript 和 TypeScript 環境,Node SDK 遵循相同的模式。使用正確的基礎 URL 和憑證初始化客戶端。這確保您的現有程式碼庫在切換供應商時只需進行最少更改。uncensored 模型 ID 與所有標準聊天補全參數相容。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Node SDK 也支援 async/await 模式,使其易於整合至 Express 路由或無伺服器函式中。將 API 金鑰保留在環境變數中,以防止意外洩露。這種 openai compatible api 設計意味著您可以透過僅更改設定物件,輕鬆切換回 OpenAI 或其他供應商。
串流回應
在請求中設定 stream: true 以啟用串流。API 會傳回伺服器發送事件 (SSE) 串流,讓您在生成 token 時進行處理。這降低了最終使用者的感知延遲,對於即時代理互動至關重要。串流格式與 OpenAI SSE 規範完全相同。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
每個區塊包含部分增量資料。您必須累積這些增量以重建完整回應。串流不會影響計費;無論是否處於串流模式,您都將為總輸入和輸出 token 付費。此功能是我們提供的強大 chat completions api 設計的一部分。
限制、錯誤與上下文
我們的基礎設施實施嚴格限制以確保可靠性。每個金鑰的速率限制為 每分鐘 300 個請求,最大請求主體大小為 8 MB。上下文視窗為 100,000 個 token,提示詞與補全內容共用。如果您超過速率限制,將收到 429 錯誤。無效金鑰會返回 401,額度不足則返回 402。與許多 llm api provider 選項不同,我們不會隱藏這些限制;它們透明且一致。我們不會對您的資料進行訓練,並透過不使用提示詞來改進模型來維護隱私。
技術規格
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| Base URL | https://api.llmmodelsapi.com/v1 |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 驗證 | Authorization: Bearer YOUR_KEY |
| 模型 ID | uncensored |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 最大輸出 | 不另設輸出上限;提示+回覆共 64,000 個 token 視窗內,max_tokens 可選 |
| 上下文視窗 | 64,000 tokens(輸入與輸出合計) |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 請求大小 | 每次請求不超過 8 MB |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
這與 GPT-4 或 Claude 是同一個模型嗎?
不是。我們的模型是一個開放權重模型,專門針對無審查回應進行微調。它不是 GPT、Claude、Gemini 或其他供應商提供的模型。它是運行在我們自有 GPU 伺服器上的獨立模型。
定價如何運作?
我們採用按量付費的預付額度系統,無月費。輸入 token 每 1M 個收費 $0.25,輸出 token 每 1M 個收費 $1.00。額度永不過期,且您可以透過加密貨幣(USDT 或 USDC)進行儲值,最低金額為 $10。
試用額度是什麼?
每個新帳戶都會獲得 $0.50 的免費試用額度,有效期為 7 天。開始使用無需信用卡或手機號碼。這讓您在決定購買之前,可以先測試 <code>uncensored ai model</code>。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。這就是整個設定過程。