Интеграция API модели без цензуры
Получите API-ключ модели без цензуры и интегрируйте эндпоинт чат-завершений за считанные минуты. Измените base_url и ключ, чтобы переключиться на нашу готовую замену API, совместимого с OpenAI, для мгновенных ответов без отказов.
Аутентификация и базовый URL
Наш API-интерфейс — готовая замена для существующих клиентов OpenAI. Вам нужно изменить только две переменные: base_url и ваш api_key. Базовый URL для всех запросов — https://api.llmmodelsapi.com/v1. Аутентификация через заголовок Authorization с Bearer-токеном. Храните API-ключ в безопасности, так как он дает доступ к предоплаченному балансу. Вы можете сгенерировать новый ключ в любое время в личном кабинете, что немедленно аннулирует старый.
Первый запрос
Отправьте стандартный запрос на чат-завершение для проверки подключения. Используйте идентификатор модели uncensored для доступа к нашей специально созданной большой языковой модели. Эта модель настроена на ответы без отказов по контенту для законного использования взрослыми, что идеально подходит для агентов, требующих стабильных результатов. Тело запроса соответствует стандартному формату чат-завершений OpenAI.
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Проверьте, что ответ содержит валидное завершение. Статус 200 означает корректную интеграцию. Этот ai model api эндпоинт поддерживает одно- и многооборотные диалоги в рамках контекстного окна.
Интеграция Python SDK
Использование официального Python SDK от OpenAI — самый быстрый способ интеграции. Укажите клиенту базовый URL и предоставьте API-ключ. SDK автоматически обрабатывает сериализацию и пул соединений. Этот подход работает с любой библиотекой клиентов, совместимой с OpenAI, которая поддерживает переопределение base_url.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Python SDK поддерживает потоковую передачу и синхронные вызовы. Для большинства рабочих процессов агентов синхронные вызовы проще, но потоковая передача доступна, если вам нужно отображать токены по мере их генерации. Идентификатор модели остается uncensored независимо от версии SDK.
Интеграция Node SDK
Для сред JavaScript и TypeScript Node SDK следует тому же шаблону. Инициализируйте клиент с правильным базовым URL и учетными данными. Это гарантирует, что вашей существующей кодовой базе потребуется минимальное изменение для смены провайдера. Идентификатор модели uncensored совместим со всеми стандартными параметрами завершения чата.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Node SDK поддерживает async/await, что упрощает интеграцию в Express или serverless-функции. Храните API-ключ в переменных окружения, чтобы избежать случайного раскрытия. Такой openai compatible api дизайн позволяет вернуться к OpenAI или сменить провайдера, изменив только объект конфигурации.
Потоковые ответы
Включите потоковую передачу, установив stream: true в запросе. API возвращает поток Server-Sent Events (SSE), позволяя обрабатывать токены по мере их генерации. Это снижает воспринимаемую задержку для конечных пользователей и необходимо для взаимодействий агентов в реальном времени. Формат потока идентичен спецификации SSE OpenAI.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Каждый чанк содержит частичные дельта-данные. Их нужно накопить для восстановления ответа. Потоковая передача не влияет на цену: вы платите за все токены. Это часть надёжного дизайна chat completions api.
Лимиты, ошибки и контекст
Наша инфраструктура строго ограничивает ресурсы для надёжности. Лимит: 300 запросов в минуту на ключ, макс. размер тела запроса — 8 MB. Контекстное окно — 100,000 токенов, включая промпт и завершение. При превышении лимита вы получите ошибку 429. Неверный ключ возвращает 401, недостаток средств — 402. В отличие от многих llm api provider, мы не скрываем эти лимиты; они прозрачны и постоянны. Данные не обучаются, приватность сохраняется, промпты не используются для улучшения модели.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| Base URL | https://api.llmmodelsapi.com/v1 |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| ID модели | uncensored |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| JSON-режим | response_format: {"type": "json_object"} |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Максимум ответа | до остатка окна в 64 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Контекстное окно | 64 000 токенов (вход и ответ вместе) |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Размер запроса | до 8 МБ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Параллельные запросы | до 8 одновременно на ключ |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Бонус | +5% от $50, +10% от $100 |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Это та же модель, что и GPT-4 или Claude?
Нет. Наша модель — это модель с открытыми весами, настроенная специально для ответов без цензуры. Это не GPT, Claude, Gemini или какая-либо другая модель поставщика. Это отдельная модель, работающая на наших собственных GPU-серверах.
Как работает ценообразование?
Мы используем систему предоплаченного баланса с оплатой по факту без ежемесячных платежей. Входные токены стоят $0,25 за 1 млн, выходные токены — $1,00 за 1 млн. Баланс не сгорает, и вы можете пополнить его криптовалютой (USDT или USDC) от $10.
Что такое пробный баланс?
Каждый новый аккаунт получает $0,50 пробного баланса, действительного в течение 7 дней. Для начала не требуется кредитная карта или номер телефона. Это позволяет вам протестировать <code>модель без цензуры</code> перед покупкой.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.