Integre a API do Modelo de IA sem Censura
Obtenha sua chave de API do modelo de IA sem censura e integre o endpoint de conclusões de chat em minutos. Altere seu base_url e chave para alternar para nossa API compatível com OpenAI pronta para uso para respostas imediatas sem recusa.
Autenticação e URL Base
Nossa API foi projetada como uma substituição pronta para uso para clientes OpenAI existentes. Você só precisa alterar duas variáveis: o base_url e sua api_key. A URL base para todas as requisições é https://api.llmmodelsapi.com/v1. A autenticação é tratada via cabeçalho Authorization usando um token Bearer. Certifique-se de manter sua chave de API segura, pois ela concede acesso ao seu crédito pré-pago. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga imediatamente a chave antiga.
Primeira Requisição
Envie uma solicitação padrão de conclusão de chat para testar a conectividade. Use o ID do modelo uncensored para acessar nosso modelo de linguagem grande construído especificamente para este fim. Este modelo é ajustado para responder sem recusas de conteúdo para uso adulto lícito, sendo ideal para agentes que precisam de saídas consistentes. O corpo da solicitação segue o formato padrão de conclusões de chat da OpenAI.
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Verifique se a resposta inclui uma conclusão válida. Se você receber um código de status 200, sua integração está funcionando corretamente. Este endpoint de ai model api suporta conversas de turno único e multi-turno dentro da janela de contexto.
Integração com SDK Python
Usar o SDK Python oficial da OpenAI é a maneira mais rápida de integrar. Aponte o cliente para nossa URL base e forneça sua chave de API. O SDK lida com serialização e pool de conexões automaticamente. Esta abordagem funciona com qualquer biblioteca de cliente compatível com OpenAI que respeite a substituição de base_url.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
O SDK Python suporta chamadas em streaming e síncronas. Para a maioria dos fluxos de trabalho de agentes, chamadas síncronas são mais simples, mas o streaming está disponível se você precisar exibir tokens conforme são gerados. O ID do modelo permanece uncensored independentemente da versão do SDK.
Integração com SDK Node.js
Para ambientes JavaScript e TypeScript, o SDK Node segue o mesmo padrão. Inicialize o cliente com a URL base e credenciais corretas. Isso garante que sua base de código existente exija alterações mínimas para alternar de provedor. O ID do modelo uncensored é compatível com todos os parâmetros padrão de conclusão de chat.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
O SDK Node também suporta padrões async/await, facilitando a integração em rotas Express ou funções serverless. Mantenha sua chave de API em variáveis de ambiente para evitar exposição acidental. Este design de openai compatible api significa que você pode trocar de volta para a OpenAI ou mudar para outros provedores alterando apenas o objeto de configuração.
Respostas em Streaming
Ative o streaming definindo stream: true em sua solicitação. A API retorna um stream de Server-Sent Events (SSE), permitindo que você processe tokens conforme são gerados. Isso reduz a latência percebida para usuários finais e é essencial para interações de agentes em tempo real. O formato do stream é idêntico à especificação SSE da OpenAI.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Cada fragmento contém dados parciais de delta. Você deve acumular esses deltas para reconstruir a resposta completa. O streaming não afeta o preço; você é cobrado pelos tokens totais de entrada e saída, independentemente do modo de streaming. Este recurso faz parte do design robusto da chat completions api que fornecemos.
Limites, Erros e Contexto
Nossa infraestrutura impõe limites rigorosos para garantir a confiabilidade. Você está limitado a 300 requisições por minuto por chave, com um tamanho máximo de corpo de requisição de 8 MB. A janela de contexto é de 100.000 tokens, compartilhada entre prompt e conclusão. Se você exceder o limite de requisições, receberá um erro 429. Uma chave inválida retorna 401, e crédito insuficiente retorna 402. Ao contrário de muitas opções de llm api provider, não escondemos esses limites; eles são transparentes e consistentes. Nenhum treinamento é realizado com seus dados, e a privacidade é mantida sem usar prompts para melhoria do modelo.
Recursos e limites
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Base URL | https://api.llmmodelsapi.com/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| ID do modelo | uncensored |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Modo JSON | response_format: {"type": "json_object"} |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Saída máxima | até o restante da janela de 64.000 tokens; max_tokens opcional (sem limite separado) |
| Janela de contexto | 64.000 tokens (entrada + saída) |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tamanho | até 8 MB por requisição |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Validade | crédito pago não expira, sem assinatura |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Este é o mesmo modelo do GPT-4 ou do Claude?
Não. Nosso modelo é um modelo de pesos abertos ajustado especificamente para respostas sem censura. Não é GPT, Claude, Gemini ou qualquer outro modelo de fornecedor. É um modelo distinto executado em nossos próprios servidores GPU.
Como funciona o preço?
Usamos um sistema de crédito pré-pago pagamento por uso sem mensalidades. Tokens de entrada custam $0,25 por 1M e tokens de saída custam $1,00 por 1M. Créditos nunca expiram e você pode recarregar com criptomoedas (USDT ou USDC) a partir de $10.
O que é o crédito de teste?
Cada nova conta recebe $0,50 em crédito de teste válido por 7 dias. Não é necessário cartão de crédito ou número de telefone para começar. Isso permite que você teste o <code>modelo de IA sem censura</code> antes de se comprometer com uma compra.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.