HI ▾
API कुंजी पाएँ

अनसेंसर्ड AI मॉडल API को एकीकृत करें

अपना अनसेंसर्ड AI मॉडल API कुंजी प्राप्त करें और मिनटों में चैट पूर्णता एंडपॉइंट को एकीकृत करें। तुरंत, अस्वीकृति-मुक्त प्रतिक्रियाओं के लिए हमारे ड्रॉप-इन OpenAI संगत API पर स्विच करने के लिए अपनी base_url और कुंजी बदलें।

प्रमाणीकरण और बेस URL

हमारा API मौजूदा OpenAI क्लाइंट्स के लिए एक ड्रॉप-इन रिप्लेसमेंट के रूप में डिज़ाइन किया गया है। आपको केवल दो वेरिएबल्स बदलने की आवश्यकता है: base_url और आपकी api_key। सभी अनुरोधों के लिए बेस URL https://api.llmmodelsapi.com/v1 है। प्रमाणीकरण Bearer टोकन का उपयोग करके Authorization हेडर के माध्यम से किया जाता है। सुनिश्चित करें कि आपकी API कुंजी सुरक्षित रहे, क्योंकि यह आपके प्रीपेड क्रेडिट तक पहुंच प्रदान करती है। आप अपने डैशबोर्ड से किसी भी समय अपनी कुंजी को पुनः उत्पन्न कर सकते हैं, जिससे तुरंत पुरानी कुंजी रद्द हो जाती है।

पहला अनुरोध

कनेक्टिविटी का परीक्षण करने के लिए एक मानक चैट पूर्णता अनुरोध भेजें। हमारे विशेष रूप से बनाए गए बड़े भाषा मॉडल तक पहुंचने के लिए uncensored मॉडल ID का उपयोग करें। यह मॉडल कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून किया गया है, जो एजेंट्स के लिए आदर्श है जिन्हें स्थिर आउटपुट की आवश्यकता होती है। अनुरोध बॉडी मानक OpenAI चैट पूर्णता प्रारूप का पालन करती है।

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

सुनिश्चित करें कि प्रतिक्रिया में एक मान्य पूर्णता शामिल है। यदि आपको 200 स्टेटस कोड प्राप्त होता है, तो आपका एकीकरण सही ढंग से काम कर रहा है। यह ai model api एंडपॉइंट कॉन्टेक्स्ट विंडो के भीतर एकल-चरण और बहु-चरण संवादों दोनों का समर्थन करता है।

Python SDK एकीकरण

औपचारिक OpenAI Python SDK का उपयोग करना एकीकरण का सबसे तेज़ तरीका है। क्लाइंट को हमारे बेस URL पर निर्देशित करें और अपनी API कुंजी प्रदान करें। SDK स्वचालित रूप से सीरियलाइज़ेशन और कनेक्शन पूलिंग संभालता है। यह दृष्टिकोण किसी भी OpenAI-संगत क्लाइंट लाइब्रेरी के साथ काम करता है जो base_url ओवरराइड का सम्मान करती है।

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Python SDK स्ट्रीमिंग और सिंक्रोनस कॉल दोनों का समर्थन करता है। अधिकांश एजेंट वर्कफ़्लो के लिए, सिंक्रोनस कॉल सरल होती हैं, लेकिन यदि आपको टोकन जनरेट होते हुए प्रदर्शित करने की आवश्यकता है तो स्ट्रीमिंग उपलब्ध है। मॉडल ID SDK संस्करण के बावजूद uncensored ही रहती है।

Node SDK एकीकरण

JavaScript और TypeScript वातावरण के लिए, Node SDK उसी पैटर्न का पालन करता है। सही बेस URL और क्रेडेंशियल के साथ क्लाइंट को इनिशियलाइज़ करें। यह सुनिश्चित करता है कि आपके मौजूदा कोडबेस को प्रदाता बदलने के लिए न्यूनतम परिवर्तनों की आवश्यकता होती है। uncensored मॉडल ID सभी मानक चैट पूर्णता पैरामीटर के साथ संगत है।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Node SDK में async/await पैटर्न भी समर्थित हैं, जिससे Express राउट या सर्वरलेस फ़ंक्शनों में एकीकरण आसान हो जाता है। अप्रकट होने से बचने के लिए अपनी API कुंजी को वातावरण चर में रखें। यह openai compatible api डिज़ाइन का अर्थ है कि आप केवल कॉन्फ़िगरेशन ऑब्जेक्ट को बदलकर OpenAI पर वापस जा सकते हैं या अन्य प्रदाताओं में बदलाव कर सकते हैं।

स्ट्रीमिंग प्रतिक्रियाएं

अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। API एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है, जिससे आप टोकन को जनरेट होते ही प्रोसेस कर सकते हैं। इससे अंत-उपयोगकर्ताओं के लिए अनुभवगत लेटेंसी कम होती है और यह रियल-टाइम एजेंट इंटरैक्शन के लिए आवश्यक है। स्ट्रीम फॉर्मेट OpenAI SSE स्पेसिफिकेशन के समान है।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

प्रत्येक चंक में आंशिक डेल्टा डेटा होता है। आपको पूर्ण प्रतिक्रिया को पुनर्गठित करने के लिए इन डेल्टा को संचित करना होगा। स्ट्रीमिंग मूल्य निर्धारण को प्रभावित नहीं करता है; आप स्ट्रीमिंग मोड की परवाह किए बिना कुल इनपुट और आउटपुट टोकन के लिए चार्ज होते हैं। यह सुविधा हमारे द्वारा प्रदान की जाने वाली chat completions api डिज़ाइन का हिस्सा है।

सीमाएं, त्रुटियां और कॉन्टेक्स्ट

हमारी इंफ्रास्ट्रक्चर विश्वसनीयता सुनिश्चित करने के लिए कड़े नियम लागू करती है। आपकी कुंजी प्रति 300 अनुरोध प्रति मिनट की सीमा है, और अधिकतम अनुरोध बॉडी आकार 8 MB है। कॉन्टेक्स्ट विंडो 100,000 टोकन की है, जो प्रॉम्प्ट और पूर्णता दोनों के लिए साझा है। यदि आप रेट लिमिट से अधिक हो जाते हैं, तो आपको 429 त्रुटि मिलेगी। एक अमान्य कुंजी 401 लौटाती है, और अपर्याप्त क्रेडिट 402 लौटाता है। कई llm api provider विकल्पों के विपरीत, हम इन सीमाओं को छुपाते नहीं हैं; वे पारदर्शी और स्थिर हैं। आपके डेटा पर कोई प्रशिक्षण नहीं किया जाता है, और प्रॉम्प्ट को मॉडल सुधार के लिए उपयोग न करके गोपनीयता बनाए रखी जाती है।

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
Base URLhttps://api.llmmodelsapi.com/v1
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
मॉडल IDuncensored
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
अधिकतम आउटपुट64,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
कॉन्टेक्स्ट विंडो64,000 टोकन (इनपुट + आउटपुट मिलाकर)
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
अनुरोध का आकार8 MB तक
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
बोनस$50 से +5%, $100 से +10%
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें
01

प्रश्न और उत्तर

क्या यह GPT-4 या Claude के समान मॉडल है?

नहीं। हमारा मॉडल एक ओपन-वेट मॉडल है जिसे विशेष रूप से बिना सेंसर प्रतिक्रियाओं के लिए ट्यून किया गया है। यह GPT, Claude, Gemini या किसी अन्य विक्रेता का मॉडल नहीं है। यह एक अलग मॉडल है जो हमारे अपने GPU सर्वरों पर चलाया जाता है।

मूल्य निर्धारण कैसे काम करता है?

हम मासिक शुल्क के बिना पे-एज़-यू-गो प्रीपेड क्रेडिट सिस्टम का उपयोग करते हैं। इनपुट टोकन की कीमत $0.25 प्रति 1M है, और आउटपुट टोकन की कीमत $1.00 प्रति 1M है। क्रेडिट कभी समाप्त नहीं होते हैं, और आप $10 से शुरू होने वाली क्रिप्टो (USDT या USDC) के साथ टॉप-अप कर सकते हैं।

ट्रायल क्रेडिट क्या है?

प्रत्येक नए खाते को 7 दिनों के लिए वैध $0.50 का ट्रायल क्रेडिट प्राप्त होता है। शुरू करने के लिए क्रेडिट कार्ड या फ़ोन नंबर की आवश्यकता नहीं है। यह आपको खरीदारी करने से पहले <code>uncensored ai model</code> का परीक्षण करने की अनुमति देता है।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ