Integriere die API des unzensierten KI-Modells
Hole deinen API-Schlüssel für das unzensierte KI-Modell und integriere den Chat-Antwort-Endpunkt in Minuten. Ändere deine base_url und deinen Schlüssel, um zu unserer sofort einsetzbaren OpenAI-kompatiblen API zu wechseln und sofortige, zensurfreie Antworten zu erhalten.
Authentifizierung und Base URL
Unsere API ist als sofort einsetzbarer Ersatz für bestehende OpenAI-Clients konzipiert. Du musst nur zwei Variablen ändern: die base_url und deinen api_key. Die Basis-URL für alle Anfragen ist https://api.llmmodelsapi.com/v1. Die Authentifizierung erfolgt über den Authorization-Header mit einem Bearer-Token. Halte deinen API-Schlüssel sicher, da er Zugriff auf dein Prepaid-Guthaben gewährt. Du kannst deinen Schlüssel jederzeit im Dashboard neu generieren, wodurch der alte sofort ungültig wird.
Erste Anfrage
Sende eine Standard-Anfrage für chat completions, um die Konnektivität zu testen. Verwende die Modell-ID uncensored, um auf unser speziell entwickeltes Large Language Model zuzugreifen. Dieses Modell ist darauf abgestimmt, ohne Inhaltsfilter bei rechtmäßiger Erwachsenennutzung zu antworten, was es ideal für Agents macht, die konsistente Ausgaben benötigen. Der Anfragekörper folgt dem Standardformat für OpenAI chat completions.
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Überprüfe, ob die Antwort eine gültige Vervollständigung enthält. Wenn du einen 200-Statuscode erhältst, funktioniert deine Integration korrekt. Dieser ai model api-Endpunkt unterstützt sowohl Single-Turn- als auch Multi-Turn-Gespräche innerhalb des Kontextfensters.
Python SDK-Integration
Die Verwendung des offiziellen OpenAI Python SDK ist der schnellste Weg zur Integration. Weise den Client auf unsere Base URL hin und gib deinen API-Schlüssel an. Das SDK übernimmt die Serialisierung und Connection Pooling automatisch. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek, die die base_url-Überschreibung unterstützt.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Das Python SDK unterstützt Streaming und synchrone Aufrufe. Für die meisten Agent-Workflows sind synchrone Aufrufe einfacher, aber Streaming ist verfügbar, wenn du Token während der Generierung anzeigen möchtest. Die Modell-ID bleibt uncensored, unabhängig von der SDK-Version.
Node SDK-Integration
Für JavaScript- und TypeScript-Umgebungen folgt das Node SDK demselben Muster. Initialisiere den Client mit der korrekten Basis-URL und den Anmeldeinformationen. So erfordert deine bestehende Codebasis minimale Änderungen beim Anbieterwechsel. Die Modell-ID uncensored ist mit allen Standard-Parametern für chat completions kompatibel.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Das Node SDK unterstützt ebenfalls async/await-Muster, was die Integration in Express-Routes oder serverlose Funktionen erleichtert. Bewahre deinen API-Schlüssel in Umgebungsvariablen auf, um unbeabsichtigte Offenlegung zu verhindern. Dieses openai compatible api-Design bedeutet, dass du nur das Konfigurationsobjekt ändern musst, um zu OpenAI zurückzuwechseln oder zu anderen Anbietern zu wechseln.
Streaming-Antworten
Aktiviere Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt einen Server-Sent Events (SSE)-Stream zurück, sodass du Token verarbeiten kannst, während sie generiert werden. Dies reduziert die wahrgenommene Latenz für Endnutzer und ist für Echtzeit-Agent-Interaktionen unerlässlich. Das Stream-Format entspricht exakt der OpenAI SSE-Spezifikation.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Jeder Chunk enthält partielle Delta-Daten. Du musst diese Deltas akkumulieren, um die vollständige Antwort zu rekonstruieren. Streaming beeinflusst die Preise nicht; du wirst für die Gesamtzahl der Input- und Output-Token berechnet, unabhängig vom Streaming-Modus. Dieses Feature ist Teil des robusten chat completions api-Designs, das wir bereitstellen.
Limits, Fehler und Kontext
Unsere Infrastruktur erzwingt strenge Grenzwerte, um Zuverlässigkeit zu gewährleisten. Du bist auf 300 Anfragen pro Minute pro Schlüssel begrenzt, mit einer maximalen Anforderungskörpergröße von 8 MB. Das Kontextfenster beträgt 100.000 Token, geteilt zwischen Prompt und Vervollständigung. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Ein ungültiger Schlüssel gibt 401 zurück, und unzureichendes Guthaben gibt 402 zurück. Im Gegensatz zu vielen llm api provider-Optionen verbergen wir diese Grenzwerte nicht; sie sind transparent und konsistent. Es findet kein Training an deinen Daten statt, und die Privatsphäre wird gewahrt, indem Prompts nicht zur Modellverbesserung verwendet werden.
Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Base-URL | https://api.llmmodelsapi.com/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| JSON-Modus | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Max. Ausgabe | bis zum Rest des 64.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Kontextfenster | 64.000 Tokens (Eingabe + Ausgabe) |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist dies das gleiche Modell wie GPT-4 oder Claude?
Nein. Unser Modell ist ein Open-Weight-Modell, das speziell für unzensierte Antworten optimiert wurde. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Es ist ein eigenständiges Modell, das auf unseren eigenen GPU-Servern läuft.
Wie funktioniert die Preisgestaltung?
Wir nutzen ein Pay as you go Prepaid-Guthaben-System ohne monatliche Gebühren. Input-Token kosten $0,25 pro 1M, Output-Token kosten $1,00 pro 1M. Guthaben verfällt nie, und du kannst ab $10 mit Krypto (USDT oder USDC) aufladen.
Was ist das trial credit?
Jedes neue Konto erhält $0,50 an trial credit, die 7 Tage gültig sind. Keine Kreditkarte oder Telefonnummer ist erforderlich. So kannst du das <code>uncensored ai model</code> testen, bevor du dich zu einem Kauf entschließt.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle einen Account, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.