ผสาน API โมเดล AI แบบไม่เซ็นเซอร์
รับคีย์ API โมเดล AI แบบไม่เซ็นเซอร์และผสานเอนด์พอยต์ chat completion ในไม่กี่นาที เปลี่ยน base_url และคีย์เพื่อสลับไปใช้ API ที่เข้ากันได้กับ OpenAI ของเราเพื่อรับคำตอบทันทีที่ไม่มีการปฏิเสธ
การตรวจสอบสิทธิ์และ Base URL
API ของเราออกแบบมาเพื่อเป็นทางเลือกแทน OpenAI clients ที่มีอยู่ คุณต้องเปลี่ยนเพียงสองตัวแปร: base_url และ api_key Base URL สำหรับคำขอทั้งหมดคือ https://api.llmmodelsapi.com/v1 การตรวจสอบสิทธิ์ทำผ่าน header Authorization โดยใช้ Bearer token โปรดรักษาความปลอดภัยของคีย์ API เนื่องจากคีย์นี้จะเข้าถึงเครดิตแบบเติมเงินล่วงหน้าของคุณ คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อจากแดชบอร์ด ซึ่งจะยกเลิกคีย์เก่าทันที
คำขอแรก
ส่งคำขอ chat completion มาตรฐานเพื่อทดสอบการเชื่อมต่อ ใช้ ID โมเดล uncensored เพื่อเข้าถึงโมเดลภาษาขนาดใหญ่ที่ออกแบบมาเพื่อจุดประสงค์นี้โดยเฉพาะ โมเดลนี้ได้รับการปรับแต่งให้ตอบคำถามโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ทำให้เหมาะสำหรับเอเจนต์ที่ต้องการผลลัพธ์ที่สม่ำเสมอ โครงร่างคำขอเป็นไปตามรูปแบบ chat completions มาตรฐานของ OpenAI
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
ตรวจสอบว่าคำตอบรวมถึงการตอบกลับที่ถูกต้อง หากได้รับรหัสสถานะ 200 แสดงว่าการผสานรวมของคุณทำงานถูกต้อง เอนด์พอยต์ ai model api นี้รองรับทั้งการสนทนาแบบครั้งเดียวและหลายรอบภายในหน้าต่างบริบท
การผสาน SDK Python
การใช้ Python SDK ทางการของ OpenAI เป็นวิธีที่เร็วที่สุดในการผสานรวม ชี้ไคลเอนต์ไปยัง base URL ของเราและระบุ API key ของคุณ SDK จัดการการ serialize และการจัดการ connection pool โดยอัตโนมัติ วิธีนี้ใช้งานได้กับไลบรารีไคลเอนต์ที่เข้ากันได้กับ OpenAI ทุกตัวที่เคารพการกำหนดค่าใหม่ base_url
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Python SDK รองรับทั้งการสตรีมมิงและการเรียกแบบซิงโครนัส สำหรับเวิร์กโฟลว์ agents ส่วนใหญ่ การเรียกแบบซิงโครนัสจะง่ายกว่า แต่การสตรีมมิงมีอยู่หากคุณต้องการแสดงโทเคนเมื่อสร้าง ID โมเดลยังคงเป็น uncensored ไม่ว่าเวอร์ชัน SDK จะเป็นอย่างไร
การผสาน SDK Node
สำหรับสภาพแวดล้อม JavaScript และ TypeScript Node SDK ปฏิบัติตามรูปแบบเดียวกัน เริ่มต้นไคลเอนต์ด้วย base URL และข้อมูลรับรองที่ถูกต้อง สิ่งนี้ทำให้โค้ดเบสที่มีอยู่ของคุณต้องเปลี่ยนแปลงน้อยที่สุดในการเปลี่ยนผู้ให้บริการ ID โมเดล uncensored เข้ากันได้กับพารามิเตอร์ chat completion มาตรฐานทั้งหมด
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
SDK Node ยังรองรับรูปแบบ async/await ทำให้ผสานเข้ากับ Express routes หรือฟังก์ชัน serverless ได้ง่าย เก็บ API key ของคุณในตัวแปรสภาพแวดล้อมเพื่อป้องกันการเปิดเผยโดยไม่ตั้งใจ การออกแบบ openai compatible api นี้หมายความว่าคุณสามารถสลับกลับไปยัง OpenAI หรือเปลี่ยนไปใช้ผู้ให้บริการรายอื่นโดยการเปลี่ยนเฉพาะวัตถุการกำหนดค่า
การตอบกลับแบบสตรีมมิง
เปิดใช้งานการสตรีมมิงโดยตั้งค่า stream: true ในคำขอของคุณ API ส่งคืนสตรีม Server-Sent Events (SSE) ทำให้คุณสามารถประมวลผลโทเคนเมื่อสร้างได้ สิ่งนี้ลดเวลาแฝงที่รับรู้สำหรับผู้ใช้ปลายทางและจำเป็นสำหรับการโต้ตอบของ agents แบบเรียลไทม์ รูปแบบสตรีมเหมือนกันกับข้อกำหนด SSE ของ OpenAI
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
แต่ละ chunk มีข้อมูล delta ส่วนย่อย คุณต้องรวบรวม delta เหล่านี้เพื่อสร้างการตอบกลับเต็มรูปแบบ การสตรีมมิงไม่ส่งผลต่อราคา คุณจะถูกเรียกเก็บเงินสำหรับโทเคนอินพุตและเอาต์พุตทั้งหมดโดยไม่คำนึงถึงโหมดสตรีมมิง คุณสมบัตินี้เป็นส่วนหนึ่งของการออกแบบ chat completions api ที่แข็งแกร่งที่เรานำเสนอ
ขีดจำกัด ข้อผิดพลาด และบริบท
โครงสร้างพื้นฐานของเราบังคับใช้ขีดจำกัดที่เข้มงวดเพื่อให้แน่ใจถึงความน่าเชื่อถือ คุณมีขีดจำกัดที่ 300 requests per minute ต่อคีย์ พร้อมขนาดร่างกายคำขอสูงสุด 8 MB หน้าต่างบริบทคือ 100,000 tokens ซึ่งแชร์ระหว่าง prompt และการสร้างผลลัพธ์ หากคุณเกินขีดจำกัดอัตรา คุณจะรับข้อผิดพลาด 429 คีย์ที่ไม่ถูกต้องจะส่งคืน 401 และเครดิตไม่เพียงพอจะส่งคืน 402 ต่างจากตัวเลือก llm api provider หลายรายการ เราไม่ซ่อนขีดจำกัดเหล่านี้ พวกมันโปร่งใสและสอดคล้องกัน ไม่มีการฝึกข้อมูลบนข้อมูลของคุณ และความเป็นส่วนตัวได้รับการรักษาโดยการไม่ใช้ prompt เพื่อปรับปรุงโมเดล
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| Base URL | https://api.llmmodelsapi.com/v1 |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| ID โมเดล | uncensored |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 64,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| หน้าต่างบริบท | 64,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
นี่เป็นโมเดลเดียวกับ GPT-4 หรือ Claude หรือไม่?
ไม่ใช่ โมเดลของเราเป็น open-weight model ที่ปรับแต่งมาเพื่อ uncensored responses โดยเฉพาะ ไม่ใช่ GPT, Claude, Gemini หรือโมเดลของผู้จัดจำหน่ายรายอื่น เป็นโมเดลที่แยกต่างหากและรันบนเซิร์ฟเวอร์ GPU ของเรา
วิธีการคิดราคาเป็นอย่างไร?
เราใช้ระบบ prepaid credit แบบ pay-as-you-go ไม่มีค่าธรรมเนียมรายเดือน Input token ราคา $0.25 ต่อ 1M และ output token ราคา $1.00 ต่อ 1M เครดิตไม่หมดอายุ และคุณสามารถเติมเงินด้วยคริปโต (USDT หรือ USDC) เริ่มต้นที่ $10
เครดิตทดลองใช้คืออะไร?
บัญชีใหม่ทุกบัญชีจะได้รับ trial credit $0.50 ใช้ได้ภายใน 7 วัน ไม่ต้องใช้บัตรเครดิตหรือเบอร์โทรศัพท์เพื่อเริ่มต้น สิ่งนี้ช่วยให้คุณทดสอบ <code>uncensored ai model</code> ก่อนตัดสินใจซื้อ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน base_url นั่นคือการตั้งค่าทั้งหมด