Zintegruj API modelu AI bez cenzury
Uzyskaj klucz API modelu AI bez cenzury i zintegruj endpoint ukończeń czatu w kilka minut. Zmień base_url i klucz, aby przełączyć się na nasze API kompatybilne z OpenAI zapewniające natychmiastowe odpowiedzi bez odmów.
Uwierzytelnianie i Base URL
Nasz API jest zaprojektowany jako bezproblemowa wymiana dla istniejących klientów OpenAI. Musisz zmienić tylko dwie zmienne: base_url oraz swój api_key. Podstawowy URL dla wszystkich zapytań to https://api.llmmodelsapi.com/v1. Autoryzacja odbywa się za pomocą nagłówka Authorization z tokenem Bearer. Upewnij się, że przechowujesz swój klucz API w bezpiecznym miejscu, ponieważ daje on dostęp do Twojego przedpłaconego kredytu. Możesz wygenerować klucz ponownie w dowolnym momencie z panelu, co natychmiast unieważnia poprzedni.
Pierwsze zapytanie
Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować łączność. Użyj identyfikatora modelu uncensored, aby uzyskać dostęp do naszego specjalnie zaprojektowanego dużego modelu językowego. Model ten jest dostrojony do odpowiadania bez odmów treści dla użytku dorosłego, co czyni go idealnym dla agentów wymagających spójnych wyników. Treść zapytania odpowiada standardowemu formatowi uzupełnień czatu OpenAI.
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Sprawdź, czy odpowiedź zawiera poprawne uzupełnienie. Jeśli otrzymasz kod statusu 200, Twoja integracja działa prawidłowo. Ten ai model api endpoint obsługuje zarówno rozmowy jedno-, jak i wieloetapowe w ramach okna kontekstu.
Integracja z Python SDK
Użycie oficjalnego Python SDK OpenAI to najszybszy sposób na integrację. Wskaż klientowi nasz base_url i podaj swój klucz API. SDK automatycznie obsługuje serializację i pulę połączeń. To podejście działa z każdą biblioteką klienta kompatybilną z OpenAI, która respektuje nadpisanie base_url.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Python obsługuje strumieniowanie i wywołania synchroniczne. Dla większości przepływów pracy agentów wywołania synchroniczne są prostsze, ale strumieniowanie jest dostępne, jeśli potrzebujesz wyświetlać tokeny podczas ich generowania. Identyfikator modelu to uncensored niezależnie od wersji SDK.
Integracja z Node SDK
W środowiskach JavaScript i TypeScript Node SDK podąża tym samym wzorcem. Zainicjuj klienta poprawnym base_url i poświadczeniami. Zapewnia to, że istniejąca baza kodu wymaga minimalnych zmian przy zmianie dostawcy. Identyfikator modelu uncensored jest kompatybilny ze wszystkimi standardowymi parametrami ukończenia czatu.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
SDK Node.js obsługuje również wzorce async/await, co ułatwia integrację z trasami Express lub funkcjami serverless. Przechowuj swój klucz API w zmiennych środowiskowych, aby zapobiec przypadkowemu ujawnieniu. Ta koncepcja openai compatible api oznacza, że możesz wrócić do OpenAI lub przełączyć się na innych dostawców, zmieniając tylko obiekt konfiguracji.
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwraca strumień Server-Sent Events (SSE), pozwalając na przetwarzanie tokenów w miarę ich generowania. Zmniejsza to postrzeganą opóźnienie dla użytkowników końcowych i jest kluczowe dla interakcji agentów w czasie rzeczywistym. Format strumienia jest identyczny ze specyfikacją SSE OpenAI.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Każdy chunk zawiera częściowe dane delta. Musisz je zsumować, aby odtworzyć pełną odpowiedź. Strumieniowanie nie wpływa na cenę; płacisz za tokeny wejścia i wyjścia. To cecha naszego chat completions api.
Limity, błędy i kontekst
Nasza infrastruktura narzuca ścisłe limity, aby zapewnić niezawodność. Limit to 300 zapytań na minutę na klucz, przy maksymalnym rozmiarze treści zapytania 8 MB. Okno kontekstu wynosi 100 000 tokenów, dzielonych między prompt a uzupełnienie. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Nieprawidłowy klucz zwraca 401, a niewystarczający kredyt zwraca 402. W przeciwieństwie do wielu llm api provider opcji, nie ukrywamy tych limitów; są one przejrzyste i spójne. Nie przeprowadzamy trenowania na Twoich danych, a prywatność jest zachowana dzięki nieużywaniu promptów do ulepszania modelu.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Base URL | https://api.llmmodelsapi.com/v1 |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| ID modelu | uncensored |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Tryb JSON | response_format: {"type": "json_object"} |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Maks. odpowiedź | do reszty okna 64 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Okno kontekstu | 64 000 tokenów (wejście + odpowiedź) |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozmiar zapytania | do 8 MB |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy to ten sam model co GPT-4 czy Claude?
Nie. Nasz model to model o otwartych wagach dostrojony specjalnie do odpowiedzi bez cenzury. Nie jest to GPT, Claude, Gemini ani żaden inny model dostawcy. To odrębny model uruchamiany na naszych własnych serwerach GPU.
Jak działa cennik?
Stosujemy system przedpłaconego kredytu rozliczanego w modelu pay-as-you-go bez opłat miesięcznych. Tokeny wejściowe kosztują $0,25 za 1M, a tokeny wyjściowe $1,00 za 1M. Kredyty nigdy nie wygasają, a doładować możesz kryptowalutą (USDT lub USDC) od kwoty $10.
Czym jest kredyt próbny?
Każde nowe konto otrzymuje $0,50 kredytu próbnego ważnego przez 7 dni. Nie jest wymagana karta kredytowa ani numer telefonu do rozpoczęcia. Pozwala to przetestować <code>model AI bez cenzury</code> przed zakupem.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base_url. To cała konfiguracja.