PT ▾
Obter chave de API

Integre a API do Modelo de IA sem Censura

Obtenha sua chave de API do modelo de IA sem censura e integre o endpoint de conclusões de chat em minutos. Altere seu base_url e chave para alternar para nossa API compatível com OpenAI pronta para uso para respostas imediatas sem recusa.

Autenticação e URL Base

Nossa API foi projetada como uma substituição pronta para uso para clientes OpenAI existentes. Você só precisa alterar duas variáveis: o base_url e sua api_key. A URL base para todas as requisições é https://api.llmmodelsapi.com/v1. A autenticação é tratada via cabeçalho Authorization usando um token Bearer. Certifique-se de manter sua chave de API segura, pois ela concede acesso ao seu crédito pré-pago. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga imediatamente a chave antiga.

Primeira Requisição

Envie uma solicitação padrão de conclusão de chat para testar a conectividade. Use o ID do modelo uncensored para acessar nosso modelo de linguagem grande construído especificamente para este fim. Este modelo é ajustado para responder sem recusas de conteúdo para uso adulto lícito, sendo ideal para agentes que precisam de saídas consistentes. O corpo da solicitação segue o formato padrão de conclusões de chat da OpenAI.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Verifique se a resposta inclui uma conclusão válida. Se você receber um código de status 200, sua integração está funcionando corretamente. Este endpoint de ai model api suporta conversas de turno único e multi-turno dentro da janela de contexto.

Integração com SDK Python

Usar o SDK Python oficial da OpenAI é a maneira mais rápida de integrar. Aponte o cliente para nossa URL base e forneça sua chave de API. O SDK lida com serialização e pool de conexões automaticamente. Esta abordagem funciona com qualquer biblioteca de cliente compatível com OpenAI que respeite a substituição de base_url.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

O SDK Python suporta chamadas em streaming e síncronas. Para a maioria dos fluxos de trabalho de agentes, chamadas síncronas são mais simples, mas o streaming está disponível se você precisar exibir tokens conforme são gerados. O ID do modelo permanece uncensored independentemente da versão do SDK.

Integração com SDK Node.js

Para ambientes JavaScript e TypeScript, o SDK Node segue o mesmo padrão. Inicialize o cliente com a URL base e credenciais corretas. Isso garante que sua base de código existente exija alterações mínimas para alternar de provedor. O ID do modelo uncensored é compatível com todos os parâmetros padrão de conclusão de chat.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

O SDK Node também suporta padrões async/await, facilitando a integração em rotas Express ou funções serverless. Mantenha sua chave de API em variáveis de ambiente para evitar exposição acidental. Este design de openai compatible api significa que você pode trocar de volta para a OpenAI ou mudar para outros provedores alterando apenas o objeto de configuração.

Respostas em Streaming

Ative o streaming definindo stream: true em sua solicitação. A API retorna um stream de Server-Sent Events (SSE), permitindo que você processe tokens conforme são gerados. Isso reduz a latência percebida para usuários finais e é essencial para interações de agentes em tempo real. O formato do stream é idêntico à especificação SSE da OpenAI.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Cada fragmento contém dados parciais de delta. Você deve acumular esses deltas para reconstruir a resposta completa. O streaming não afeta o preço; você é cobrado pelos tokens totais de entrada e saída, independentemente do modo de streaming. Este recurso faz parte do design robusto da chat completions api que fornecemos.

Limites, Erros e Contexto

Nossa infraestrutura impõe limites rigorosos para garantir a confiabilidade. Você está limitado a 300 requisições por minuto por chave, com um tamanho máximo de corpo de requisição de 8 MB. A janela de contexto é de 100.000 tokens, compartilhada entre prompt e conclusão. Se você exceder o limite de requisições, receberá um erro 429. Uma chave inválida retorna 401, e crédito insuficiente retorna 402. Ao contrário de muitas opções de llm api provider, não escondemos esses limites; eles são transparentes e consistentes. Nenhum treinamento é realizado com seus dados, e a privacidade é mantida sem usar prompts para melhoria do modelo.

Recursos e limites

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
Base URLhttps://api.llmmodelsapi.com/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
ID do modelouncensored
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Modo JSONresponse_format: {"type": "json_object"}
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Saída máximaaté o restante da janela de 64.000 tokens; max_tokens opcional (sem limite separado)
Janela de contexto64.000 tokens (entrada + saída)
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Tamanhoaté 8 MB por requisição
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
Validadecrédito pago não expira, sem assinatura
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Bônus+5% a partir de $50, +10% a partir de $100
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos
01

Perguntas e respostas

Este é o mesmo modelo do GPT-4 ou do Claude?

Não. Nosso modelo é um modelo de pesos abertos ajustado especificamente para respostas sem censura. Não é GPT, Claude, Gemini ou qualquer outro modelo de fornecedor. É um modelo distinto executado em nossos próprios servidores GPU.

Como funciona o preço?

Usamos um sistema de crédito pré-pago pagamento por uso sem mensalidades. Tokens de entrada custam $0,25 por 1M e tokens de saída custam $1,00 por 1M. Créditos nunca expiram e você pode recarregar com criptomoedas (USDT ou USDC) a partir de $10.

O que é o crédito de teste?

Cada nova conta recebe $0,50 em crédito de teste válido por 7 dias. Não é necessário cartão de crédito ou número de telefone para começar. Isso permite que você teste o <code>modelo de IA sem censura</code> antes de se comprometer com uma compra.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API