Integrasikan API Model AI Tanpa Sensor
Dapatkan kunci API model AI tanpa sensor Anda dan integrasikan endpoint penyelesaian obrolan dalam hitungan menit. Ubah base_url dan kunci Anda untuk beralih ke API kompatibel OpenAI kami yang langsung ganti untuk respons tanpa penolakan.
Autentikasi dan URL Dasar
API kami dirancang sebagai pengganti langsung untuk klien OpenAI yang ada. Anda hanya perlu mengubah dua variabel: base_url dan api_key Anda. URL dasar untuk semua permintaan adalah https://api.llmmodelsapi.com/v1. Otentikasi ditangani melalui header Authorization menggunakan token Bearer. Pastikan Anda menjaga kunci API Anda tetap aman, karena kunci ini memberikan akses ke saldo prabayar Anda. Anda dapat membuat ulang kunci Anda kapan saja dari dasbor Anda, yang segera mencabut kunci lama.
Permintaan Pertama
Kirimkan permintaan penyelesaian obrolan standar untuk menguji konektivitas. Gunakan ID model uncensored untuk mengakses model bahasa besar kami yang dirancang khusus. Model ini disesuaikan untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, menjadikannya ideal untuk agen yang membutuhkan output yang konsisten. Badan permintaan mengikuti format penyelesaian obrolan OpenAI standar.
curl https://api.llmmodelsapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Verifikasi respons menyertakan completion yang valid. Jika Anda menerima status code 200, integrasi Anda berfungsi dengan benar. Endpoint ai model api ini mendukung percakapan single-turn dan multi-turn dalam context window.
Integrasi SDK Python
Menggunakan SDK Python OpenAI resmi adalah cara tercepat untuk mengintegrasikan. Arahkan klien ke URL dasar kami dan berikan kunci API Anda. SDK menangani serialisasi dan pengelompokan koneksi secara otomatis. Pendekatan ini berfungsi dengan pustaka klien kompatibel OpenAI apa pun yang menghormati penggantian base_url.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Python mendukung panggilan streaming dan sinkron. Untuk sebagian besar alur kerja agen, panggilan sinkron lebih sederhana, tetapi streaming tersedia jika Anda perlu menampilkan token saat dibuat. ID model tetap uncensored terlepas dari versi SDK.
Integrasi SDK Node
Untuk lingkungan JavaScript dan TypeScript, SDK Node mengikuti pola yang sama. Inisialisasi klien dengan URL dasar dan kredensial yang benar. Ini memastikan basis kode Anda memerlukan perubahan minimal untuk beralih penyedia. ID model uncensored kompatibel dengan semua parameter penyelesaian obrolan standar.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
SDK Node juga mendukung pola async/await, membuatnya mudah diintegrasikan ke rute Express atau fungsi serverless. Simpan kunci API Anda dalam variabel lingkungan untuk mencegah paparan tidak disengaja. Desain openai compatible api ini berarti Anda dapat beralih kembali ke OpenAI atau beralih ke penyedia lain hanya dengan mengubah objek konfigurasi.
Respons Streaming
Aktifkan streaming dengan mengatur stream: true dalam permintaan Anda. API mengembalikan aliran Event yang Diserahkan Server (SSE), memungkinkan Anda memproses token saat dibuat. Ini mengurangi latensi yang dirasakan untuk pengguna akhir dan penting untuk interaksi agen waktu nyata. Format aliran identik dengan spesifikasi SSE OpenAI.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Setiap bagian berisi data delta parsial. Anda harus mengumpulkan delta ini untuk memulihkan respons penuh. Streaming tidak mempengaruhi harga; Anda dibayar untuk total token input dan output terlepas dari mode streaming. Fitur ini adalah bagian dari desain chat completions api yang kuat yang kami sediakan.
Batas, Kesalahan, dan Konteks
Infrastruktur kami memberlakukan batas ketat untuk memastikan keandalan. Anda dibatasi hingga 300 permintaan per menit per kunci, dengan ukuran badan permintaan maksimum 8 MB. Jendela konteks adalah 100.000 token, dibagi antara prompt dan penyelesaian. Jika Anda melebihi batas laju, Anda akan menerima kesalahan 429. Kunci yang tidak valid mengembalikan 401, dan saldo tidak cukup mengembalikan 402. Tidak seperti banyak opsi llm api provider, kami tidak menyembunyikan batas ini; mereka transparan dan konsisten. Tidak ada pelatihan yang dilakukan pada data Anda, dan privasi dijaga dengan tidak menggunakan prompt untuk peningkatan model.
Spesifikasi teknis
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| Base URL | https://api.llmmodelsapi.com/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| ID model | uncensored |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Output maksimal | hingga sisa jendela 64.000 token; max_tokens opsional (tanpa batas terpisah) |
| Jendela konteks | 64.000 token (input + output) |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ukuran permintaan | hingga 8 MB |
| Batas laju | 300 permintaan per menit per kunci |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
| Masuk | Google atau email dan kata sandi |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Apakah ini model yang sama dengan GPT-4 atau Claude?
Tidak. Model kami adalah model bobot terbuka yang disesuaikan khusus untuk respons tanpa sensor. Ini bukan GPT, Claude, Gemini, atau model vendor lain. Ini adalah model terpisah yang dijalankan di server GPU kami sendiri.
Bagaimana cara kerja harganya?
Kami menggunakan sistem saldo prabayar pay-as-you-go tanpa biaya bulanan. Token input berharga $0,25 per 1M, dan token output berharga $1,00 per 1M. Saldo tidak pernah kedaluwarsa, dan Anda dapat mengisi saldo dengan kripto (USDT atau USDC) mulai dari $10.
Apa itu kredit uji coba?
Setiap akun baru menerima $0,50 kredit uji coba yang berlaku selama 7 hari. Tidak diperlukan kartu kredit atau nomor telepon untuk memulai. Ini memungkinkan Anda menguji <code>model ai tanpa sensor</code> sebelum memutuskan untuk membeli.
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kunci, ubah URL dasar. Itu saja seluruh pengaturannya.