NL ▾
API-sleutel aanvragen

Integreer de Uncensored AI Model API

Vraag je API-sleutel voor het ongecensureerde AI-model aan en integreer het chatcompleties-endpoint in enkele minuten. Pas je base_url en sleutel aan om over te schakelen naar onze drop-in OpenAI-compatible API voor directe, refusaloze antwoorden.

Authenticatie en Base URL

Onze API is ontworpen als een drop-in vervanging voor bestaande OpenAI-clients. Je hoeft slechts twee variabelen aan te passen: de base_url en je api_key. De basis-URL voor alle verzoeken is https://api.llmmodelsapi.com/v1. Authenticatie verloopt via de Authorization-header met een Bearer-token. Zorg dat je API-sleutel veilig blijft, omdat deze toegang geeft tot je prepaid tegoed. Je kunt je sleutel op elk moment opnieuw genereren via je dashboard, waardoor de oude sleutel onmiddellijk ongeldig wordt.

Eerste verzoek

Stuur een standaard chat-completieverzoek om de verbinding te testen. Gebruik de model-ID uncensored om toegang te krijgen tot onze op maat gemaakte grote taalmodel. Dit model is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik, wat het ideaal maakt voor agents die consistente outputs nodig hebben. De request body volgt de standaard OpenAI chat-completies indeling.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Verifieer dat de response een geldige voltooiing bevat. Als je een 200 status code ontvangt, werkt je integratie correct. Dit ai model api endpoint ondersteunt zowel single-turn als multi-turn gesprekken binnen het contextvenster.

Python SDK-integratie

Het gebruik van de officiële OpenAI Python SDK is de snelste manier om te integreren. Wijs de client aan op onze base URL en geef je API-sleutel op. De SDK verwerkt serialisatie en connection pooling automatisch. Deze aanpak werkt met elke OpenAI-compatible client library die de base_url override respecteert.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

De Python SDK ondersteunt streaming en synchronische calls. Voor de meeste agent workflows zijn synchronische calls eenvoudiger, maar streaming is beschikbaar als je tokens wilt weergeven terwijl ze worden gegenereerd. De model ID blijft uncensored, ongeacht de SDK-versie.

Node SDK-integratie

Voor JavaScript- en TypeScript-omgevingen volgt de Node SDK hetzelfde patroon. Initialiseer de client met de juiste base URL en referenties. Dit zorgt ervoor dat je bestaande codebase minimale aanpassingen nodig heeft om van provider te wisselen. De uncensored model ID is compatibel met alle standaard chat completion parameters.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

De Node SDK ondersteunt ook async/await patronen, wat integratie in Express routes of serverless functies eenvoudig maakt. Bewaar je API-sleutel in environment variables om onbedoelde blootstelling te voorkomen. Dit openai compatible api ontwerp betekent dat je kunt terugschakelen naar OpenAI of naar andere providers kunt wisselen door alleen het configuratieobject aan te passen.

Streaming-antwoorden

Schakel streaming in door stream: true in je request in te stellen. De API retourneert een Server-Sent Events (SSE) stream, waardoor je tokens kunt verwerken terwijl ze worden gegenereerd. Dit vermindert perceived latency voor eindgebruikers en is essentieel voor real-time agent interacties. De stream indeling is identiek aan de OpenAI SSE specificatie.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Elke chunk bevat gedeeltelijke delta data. Je moet deze deltas accumuleren om de volledige response te reconstrueren. Streaming heeft geen invloed op de prijsstelling; je wordt gefactureerd voor het totale aantal input en output tokens, ongeacht de streaming modus. Deze functie is onderdeel van de robuuste chat completions api indeling die we bieden.

Limieten, fouten en context

Onze infrastructuur handhaaft strikte limieten om betrouwbaarheid te garanderen. Je bent beperkt tot 300 verzoeken per minuut per sleutel, met een maximale request body grootte van 8 MB. Het contextvenster is 100.000 tokens, gedeeld tussen prompt en completion. Als je de rate limit overschrijdt, ontvang je een 429 fout. Een ongeldige sleutel retourneert 401, en onvoldoende tegoed retourneert 402. In tegenstelling tot veel llm api provider opties, verbergen we deze limieten niet; ze zijn transparant en consistent. Er wordt geen training uitgevoerd op je data, en privacy wordt gewaarborgd door prompts niet te gebruiken voor modelverbetering.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.llmmodelsapi.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Max. uitvoertot de rest van het venster van 64.000 tokens; max_tokens optioneel (geen aparte limiet)
Contextvenster64.000 tokens (invoer + uitvoer)
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw
01

Vragen en antwoorden

Is dit hetzelfde model als GPT-4 of Claude?

Nee. Ons model is een open-weight model dat specifiek is afgestemd op ongecensureerde antwoorden. Het is geen GPT, Claude, Gemini of een model van een andere leverancier. Het is een apart model dat op onze eigen GPU-servers draait.

Hoe werkt de prijsstelling?

We gebruiken een prepaid tegoedsysteem op basis van verbruik, zonder maandelijkse kosten. Input tokens kosten $0,25 per 1M, en output tokens kosten $1,00 per 1M. Credits vervallen nooit en je kunt opwaarderen met crypto (USDT of USDC) vanaf $10.

Wat is het proeftegoed?

Elk nieuw account ontvangt $0,50 aan proeftegoed dat 7 dagen geldig is. Er is geen creditcard of telefoonnummer nodig om te beginnen. Zo kun je het <code>ongecensureerde AI-model</code> testen voordat je tot aankoop overgaat.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de base URL aan. Dat is de hele setup.

API-sleutel aanvragen