DE ▾
API-Schlüssel erhalten

Integriere die API des unzensierten KI-Modells

Hole deinen API-Schlüssel für das unzensierte KI-Modell und integriere den Chat-Antwort-Endpunkt in Minuten. Ändere deine base_url und deinen Schlüssel, um zu unserer sofort einsetzbaren OpenAI-kompatiblen API zu wechseln und sofortige, zensurfreie Antworten zu erhalten.

Authentifizierung und Base URL

Unsere API ist als sofort einsetzbarer Ersatz für bestehende OpenAI-Clients konzipiert. Du musst nur zwei Variablen ändern: die base_url und deinen api_key. Die Basis-URL für alle Anfragen ist https://api.llmmodelsapi.com/v1. Die Authentifizierung erfolgt über den Authorization-Header mit einem Bearer-Token. Halte deinen API-Schlüssel sicher, da er Zugriff auf dein Prepaid-Guthaben gewährt. Du kannst deinen Schlüssel jederzeit im Dashboard neu generieren, wodurch der alte sofort ungültig wird.

Erste Anfrage

Sende eine Standard-Anfrage für chat completions, um die Konnektivität zu testen. Verwende die Modell-ID uncensored, um auf unser speziell entwickeltes Large Language Model zuzugreifen. Dieses Modell ist darauf abgestimmt, ohne Inhaltsfilter bei rechtmäßiger Erwachsenennutzung zu antworten, was es ideal für Agents macht, die konsistente Ausgaben benötigen. Der Anfragekörper folgt dem Standardformat für OpenAI chat completions.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Überprüfe, ob die Antwort eine gültige Vervollständigung enthält. Wenn du einen 200-Statuscode erhältst, funktioniert deine Integration korrekt. Dieser ai model api-Endpunkt unterstützt sowohl Single-Turn- als auch Multi-Turn-Gespräche innerhalb des Kontextfensters.

Python SDK-Integration

Die Verwendung des offiziellen OpenAI Python SDK ist der schnellste Weg zur Integration. Weise den Client auf unsere Base URL hin und gib deinen API-Schlüssel an. Das SDK übernimmt die Serialisierung und Connection Pooling automatisch. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek, die die base_url-Überschreibung unterstützt.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Das Python SDK unterstützt Streaming und synchrone Aufrufe. Für die meisten Agent-Workflows sind synchrone Aufrufe einfacher, aber Streaming ist verfügbar, wenn du Token während der Generierung anzeigen möchtest. Die Modell-ID bleibt uncensored, unabhängig von der SDK-Version.

Node SDK-Integration

Für JavaScript- und TypeScript-Umgebungen folgt das Node SDK demselben Muster. Initialisiere den Client mit der korrekten Basis-URL und den Anmeldeinformationen. So erfordert deine bestehende Codebasis minimale Änderungen beim Anbieterwechsel. Die Modell-ID uncensored ist mit allen Standard-Parametern für chat completions kompatibel.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Das Node SDK unterstützt ebenfalls async/await-Muster, was die Integration in Express-Routes oder serverlose Funktionen erleichtert. Bewahre deinen API-Schlüssel in Umgebungsvariablen auf, um unbeabsichtigte Offenlegung zu verhindern. Dieses openai compatible api-Design bedeutet, dass du nur das Konfigurationsobjekt ändern musst, um zu OpenAI zurückzuwechseln oder zu anderen Anbietern zu wechseln.

Streaming-Antworten

Aktiviere Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, sodass du Token verarbeiten kannst, während sie generiert werden. Dies reduziert die wahrgenommene Latenz für Endnutzer und ist für Echtzeit-Agent-Interaktionen unerlässlich. Das Stream-Format entspricht exakt der OpenAI SSE-Spezifikation.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Jeder Chunk enthält partielle Delta-Daten. Du musst diese Deltas akkumulieren, um die vollständige Antwort zu rekonstruieren. Streaming beeinflusst die Preise nicht; du wirst für die Gesamtzahl der Input- und Output-Token berechnet, unabhängig vom Streaming-Modus. Dieses Feature ist Teil des robusten chat completions api-Designs, das wir bereitstellen.

Limits, Fehler und Kontext

Unsere Infrastruktur erzwingt strenge Grenzwerte, um Zuverlässigkeit zu gewährleisten. Du bist auf 300 Anfragen pro Minute pro Schlüssel begrenzt, mit einer maximalen Anforderungskörpergröße von 8 MB. Das Kontextfenster beträgt 100.000 Token, geteilt zwischen Prompt und Vervollständigung. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Ein ungültiger Schlüssel gibt 401 zurück, und unzureichendes Guthaben gibt 402 zurück. Im Gegensatz zu vielen llm api provider-Optionen verbergen wir diese Grenzwerte nicht; sie sind transparent und konsistent. Es findet kein Training an deinen Daten statt, und die Privatsphäre wird gewahrt, indem Prompts nicht zur Modellverbesserung verwendet werden.

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Base-URLhttps://api.llmmodelsapi.com/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
JSON-Modusresponse_format: {"type": "json_object"}
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Max. Ausgabebis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit)
Kontextfenster64.000 Tokens (Eingabe + Ausgabe)
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Bonus+5 % ab $50, +10 % ab $100
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen
01

Fragen und Antworten

Ist dies das gleiche Modell wie GPT-4 oder Claude?

Nein. Unser Modell ist ein Open-Weight-Modell, das speziell für unzensierte Antworten optimiert wurde. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Es ist ein eigenständiges Modell, das auf unseren eigenen GPU-Servern läuft.

Wie funktioniert die Preisgestaltung?

Wir nutzen ein Pay as you go Prepaid-Guthaben-System ohne monatliche Gebühren. Input-Token kosten $0,25 pro 1M, Output-Token kosten $1,00 pro 1M. Guthaben verfällt nie, und du kannst ab $10 mit Krypto (USDT oder USDC) aufladen.

Was ist das trial credit?

Jedes neue Konto erhält $0,50 an trial credit, die 7 Tage gültig sind. Keine Kreditkarte oder Telefonnummer ist erforderlich. So kannst du das <code>uncensored ai model</code> testen, bevor du dich zu einem Kauf entschließt.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle einen Account, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten