PL ▾
Pobierz klucz API

Zintegruj API modelu AI bez cenzury

Uzyskaj klucz API modelu AI bez cenzury i zintegruj endpoint ukończeń czatu w kilka minut. Zmień base_url i klucz, aby przełączyć się na nasze API kompatybilne z OpenAI zapewniające natychmiastowe odpowiedzi bez odmów.

Uwierzytelnianie i Base URL

Nasz API jest zaprojektowany jako bezproblemowa wymiana dla istniejących klientów OpenAI. Musisz zmienić tylko dwie zmienne: base_url oraz swój api_key. Podstawowy URL dla wszystkich zapytań to https://api.llmmodelsapi.com/v1. Autoryzacja odbywa się za pomocą nagłówka Authorization z tokenem Bearer. Upewnij się, że przechowujesz swój klucz API w bezpiecznym miejscu, ponieważ daje on dostęp do Twojego przedpłaconego kredytu. Możesz wygenerować klucz ponownie w dowolnym momencie z panelu, co natychmiast unieważnia poprzedni.

Pierwsze zapytanie

Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować łączność. Użyj identyfikatora modelu uncensored, aby uzyskać dostęp do naszego specjalnie zaprojektowanego dużego modelu językowego. Model ten jest dostrojony do odpowiadania bez odmów treści dla użytku dorosłego, co czyni go idealnym dla agentów wymagających spójnych wyników. Treść zapytania odpowiada standardowemu formatowi uzupełnień czatu OpenAI.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Sprawdź, czy odpowiedź zawiera poprawne uzupełnienie. Jeśli otrzymasz kod statusu 200, Twoja integracja działa prawidłowo. Ten ai model api endpoint obsługuje zarówno rozmowy jedno-, jak i wieloetapowe w ramach okna kontekstu.

Integracja z Python SDK

Użycie oficjalnego Python SDK OpenAI to najszybszy sposób na integrację. Wskaż klientowi nasz base_url i podaj swój klucz API. SDK automatycznie obsługuje serializację i pulę połączeń. To podejście działa z każdą biblioteką klienta kompatybilną z OpenAI, która respektuje nadpisanie base_url.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Python obsługuje strumieniowanie i wywołania synchroniczne. Dla większości przepływów pracy agentów wywołania synchroniczne są prostsze, ale strumieniowanie jest dostępne, jeśli potrzebujesz wyświetlać tokeny podczas ich generowania. Identyfikator modelu to uncensored niezależnie od wersji SDK.

Integracja z Node SDK

W środowiskach JavaScript i TypeScript Node SDK podąża tym samym wzorcem. Zainicjuj klienta poprawnym base_url i poświadczeniami. Zapewnia to, że istniejąca baza kodu wymaga minimalnych zmian przy zmianie dostawcy. Identyfikator modelu uncensored jest kompatybilny ze wszystkimi standardowymi parametrami ukończenia czatu.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

SDK Node.js obsługuje również wzorce async/await, co ułatwia integrację z trasami Express lub funkcjami serverless. Przechowuj swój klucz API w zmiennych środowiskowych, aby zapobiec przypadkowemu ujawnieniu. Ta koncepcja openai compatible api oznacza, że możesz wrócić do OpenAI lub przełączyć się na innych dostawców, zmieniając tylko obiekt konfiguracji.

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwraca strumień Server-Sent Events (SSE), pozwalając na przetwarzanie tokenów w miarę ich generowania. Zmniejsza to postrzeganą opóźnienie dla użytkowników końcowych i jest kluczowe dla interakcji agentów w czasie rzeczywistym. Format strumienia jest identyczny ze specyfikacją SSE OpenAI.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Każdy chunk zawiera częściowe dane delta. Musisz je zsumować, aby odtworzyć pełną odpowiedź. Strumieniowanie nie wpływa na cenę; płacisz za tokeny wejścia i wyjścia. To cecha naszego chat completions api.

Limity, błędy i kontekst

Nasza infrastruktura narzuca ścisłe limity, aby zapewnić niezawodność. Limit to 300 zapytań na minutę na klucz, przy maksymalnym rozmiarze treści zapytania 8 MB. Okno kontekstu wynosi 100 000 tokenów, dzielonych między prompt a uzupełnienie. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Nieprawidłowy klucz zwraca 401, a niewystarczający kredyt zwraca 402. W przeciwieństwie do wielu llm api provider opcji, nie ukrywamy tych limitów; są one przejrzyste i spójne. Nie przeprowadzamy trenowania na Twoich danych, a prywatność jest zachowana dzięki nieużywaniu promptów do ulepszania modelu.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
Base URLhttps://api.llmmodelsapi.com/v1
EndpointyPOST /v1/chat/completions · GET /v1/models
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Tryb JSONresponse_format: {"type": "json_object"}
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Maks. odpowiedźdo reszty okna 64 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Okno kontekstu64 000 tokenów (wejście + odpowiedź)
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Równoległe zapytaniado 8 jednocześnie na klucz
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Bonus+5% od $50, +10% od $100
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund
01

Pytania i odpowiedzi

Czy to ten sam model co GPT-4 czy Claude?

Nie. Nasz model to model o otwartych wagach dostrojony specjalnie do odpowiedzi bez cenzury. Nie jest to GPT, Claude, Gemini ani żaden inny model dostawcy. To odrębny model uruchamiany na naszych własnych serwerach GPU.

Jak działa cennik?

Stosujemy system przedpłaconego kredytu rozliczanego w modelu pay-as-you-go bez opłat miesięcznych. Tokeny wejściowe kosztują $0,25 za 1M, a tokeny wyjściowe $1,00 za 1M. Kredyty nigdy nie wygasają, a doładować możesz kryptowalutą (USDT lub USDC) od kwoty $10.

Czym jest kredyt próbny?

Każde nowe konto otrzymuje $0,50 kredytu próbnego ważnego przez 7 dni. Nie jest wymagana karta kredytowa ani numer telefonu do rozpoczęcia. Pozwala to przetestować <code>model AI bez cenzury</code> przed zakupem.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base_url. To cała konfiguracja.

Pobierz klucz API