KO ▾
API 키 받기

무검열 AI 모델 API 통합

무검열 AI 모델 API 키를 얻고 몇 분 안에 채팅 완료 엔드포인트를 통합하세요. base_url과 키를 변경하여 즉시 거절 없는 응답을 제공하는 당사의 OpenAI 호환 API로 전환하세요.

인증 및 기본 URL

당사의 API는 기존 OpenAI 클라이언트에 대한 교체용으로 설계되었습니다. base_url과 api_key 두 가지 변수만 변경하면 됩니다. 모든 요청의 기본 URL은 https://api.llmmodelsapi.com/v1입니다. 인증은 Bearer 토큰을 사용하여 Authorization 헤더를 통해 처리됩니다. 선불 크레딧에 대한 접근 권한을 제공하므로 API 키를 안전하게 보관하세요. 대시보드에서 언제든지 키를 재생성할 수 있으며, 이 경우 이전 키는 즉시 무효화됩니다.

첫 번째 요청

연결 테스트를 위해 표준 채팅 완료 요청을 전송하세요. uncensored 모델 ID를 사용하여 전용 대형 언어 모델에 접근하세요. 이 모델은 합법적인 성인용도에서 콘텐츠 거부 없이 답변하도록 최적화되어 있어 일관된 출력이 필요한 에이전트에 이상적입니다. 요청 본문은 표준 OpenAI 채팅 완료 형식을 따릅니다.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

응답에 유효한 완료가 포함되어 있는지 확인하십시오. 200 상태 코드를 받으면 통합이 올바르게 작동하고 있습니다. 이 ai model api 엔드포인트는 컨텍스트 창 내에서 단발성 및 다중 턴 대화를 모두 지원합니다.

Python SDK 통합

공식 OpenAI Python SDK를 사용하는 것이 가장 빠른 통합 방법입니다. 클라이언트를 기본 URL로 지정하고 API 키를 제공하세요. SDK는 직렬화 및 연결 풀링을 자동으로 처리합니다. 이 방법은 base_url 재지정을 지원하는 모든 OpenAI 호환 클라이언트 라이브러리에서 작동합니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Python SDK는 스트리밍과 동기식 호출을 모두 지원합니다. 대부분의 에이전트 워크플로우에서는 동기식 호출이 더 간단하지만, 토큰 생성 시 표시해야 할 경우 스트리밍을 사용할 수 있습니다. SDK 버전과 관계없이 모델 ID는 uncensored입니다.

Node SDK 통합

JavaScript 및 TypeScript 환경에서 Node SDK는 동일한 패턴을 따릅니다. 올바른 기본 URL과 자격 증명으로 클라이언트를 초기화하십시오. 이렇게 하면 기존 코드베이스에서 공급자를 전환하는 데 최소한의 변경만 필요합니다. uncensored 모델 ID는 모든 표준 채팅 완료 매개변수와 호환됩니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Node SDK는 async/await 패턴도 지원하므로 Express 라우트나 서버리스 함수에 쉽게 통합할 수 있습니다. API 키를 환경 변수에 보관하여 우발적인 노출을 방지하세요. 이 openai compatible api 설계 덕분에 구성 객체만 변경하면 OpenAI로 다시 전환하거나 다른 공급자로 전환할 수 있습니다.

스트리밍 응답

요청에 stream: true을 설정하여 스트리밍을 활성화하십시오. API는 SSE 스트림을 반환하여 생성되는 토큰을 처리할 수 있게 합니다. 이는 최종 사용자에게 지각된 지연 시간을 줄이며 실시간 에이전트 상호 작용에 필수적입니다. 스트림 형식은 OpenAI SSE 사양과 동일합니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

각 청크에는 부분 델타 데이터가 포함됩니다. 전체 응답을 복원하려면 이러한 델타를 누적해야 합니다. 스트리밍은 가격에 영향을 주지 않으며, 스트리밍 모드 여부와 관계없이 총 입력 및 출력 토큰에 대해 요금이 부과됩니다. 이 기능은 당사가 제공하는 견고한 chat completions api 설계의 일부입니다.

제한, 오류 및 컨텍스트 창

당사의 인프라는 신뢰성을 보장하기 위해 엄격한 제한을 적용합니다. 키당 분당 300회 요청까지 제한되며, 최대 요청 본문 크기는 8 MB입니다. 컨텍스트 창은 프롬프트와 완료를 합쳐 100,000 토큰이며 공유됩니다. 속도 제한을 초과하면 429 오류가 발생합니다. 유효하지 않은 키는 401을, 잔액 부족은 402을 반환합니다. 많은 llm api provider 옵션과 달리 당사는 이러한 제한을 숨기지 않으며 투명하고 일관되게 유지합니다. 귀하의 데이터로 학습이 수행되지 않으며, 프롬프트를 모델 개선에 사용하지 않음으로써 프라이버시가 유지됩니다.

기술 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
Base URLhttps://api.llmmodelsapi.com/v1
엔드포인트POST /v1/chat/completions · GET /v1/models
인증Authorization: Bearer YOUR_KEY
모델 IDuncensored
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
JSON 모드response_format: {"type": "json_object"}
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
최대 출력64,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
컨텍스트 창64,000 토큰 (입력 + 출력)
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
요청 크기최대 8 MB
속도 제한키당 분당 300회
동시 요청키당 동시 8개
유효기간유료 크레딧은 만료되지 않으며 구독 없음
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
보너스$50 이상 +5%, $100 이상 +10%
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
로그인Google 또는 이메일과 비밀번호
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도
01

질문과 답변

GPT-4나 Claude와 같은 모델인가요?

아니요. 당사의 모델은 무검열 응답을 위해 특별히 조정된 오픈 웨이트 모델입니다. GPT, Claude, Gemini 또는 기타 벤더의 모델이 아닙니다. 자체 GPU 서버에서 실행되는 독립적인 모델입니다.

요금은 어떻게 되나요?

월 요금 없이 선불 크레딧 시스템을 사용합니다. 입력 토큰은 100만 토큰당 $0.25, 출력 토큰은 100만 토큰당 $1.00입니다. 크레딧은 만료되지 않으며, 최소 $10부터 USDT 또는 USDC로 충전할 수 있습니다.

체험 크레딧이란 무엇인가요?

모든 신규 계정에는 7일 동안 유효한 $0.50의 무료 체험 크레딧이 제공됩니다. 시작하기 위해 신용카드나 전화번호가 필요하지 않습니다. 구매 전에 <code>uncensored ai model</code>을 테스트할 수 있습니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것으로 끝입니다.

API 키 받기