VI ▾
Lấy khóa API

Tích hợp API Mô hình AI không kiểm duyệt

Lấy khóa API mô hình AI không kiểm duyệt của bạn và tích hợp endpoint hoàn thành hội thoại trong vài phút. Thay đổi base_url và khóa để chuyển sang API tương thích OpenAI của chúng tôi để có phản hồi ngay lập tức, không từ chối.

Xác thực và Base URL

API của chúng tôi được thiết kế như một giải pháp thay thế trực tiếp cho các máy khách OpenAI hiện có. Bạn chỉ cần thay đổi hai biến: base_url và api_key của bạn. Base URL cho tất cả yêu cầu là https://api.llmmodelsapi.com/v1. Xác thực được xử lý qua tiêu đề Authorization sử dụng token Bearer. Hãy đảm bảo giữ khóa API của bạn an toàn vì nó cấp quyền truy cập vào tín dụng trả trước của bạn. Bạn có thể tạo lại khóa bất cứ lúc nào từ bảng điều khiển, điều này sẽ thu hồi ngay lập tức khóa cũ.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn thành hội thoại tiêu chuẩn để kiểm tra kết nối. Sử dụng ID mô hình uncensored để truy cập mô hình ngôn ngữ lớn được xây dựng chuyên dụng của chúng tôi. Mô hình này được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp, rất lý tưởng cho các tác nhân cần đầu ra nhất quán. Thân yêu cầu tuân theo định dạng hoàn thành hội thoại OpenAI tiêu chuẩn.

curl https://api.llmmodelsapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Xác minh phản hồi bao gồm một phần hoàn thành hợp lệ. Nếu bạn nhận được mã trạng thái 200, việc tích hợp của bạn đang hoạt động đúng cách. Endpoint ai model api này hỗ trợ cả hội thoại một lượt và nhiều lượt trong cửa sổ ngữ cảnh.

Tích hợp SDK Python

Sử dụng SDK Python chính thức của OpenAI là cách nhanh nhất để tích hợp. Chỉ định máy khách vào base URL của chúng tôi và cung cấp khóa API của bạn. SDK tự động xử lý tuần tự hóa và kết nối nhóm. Cách tiếp cận này hoạt động với bất kỳ thư viện máy khách tương thích OpenAI nào tôn trọng việc ghi đè base_url.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmmodelsapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Python hỗ trợ cả gọi truyền phát và đồng bộ. Đối với hầu hết các quy trình làm việc của tác nhân, các lệnh gọi đồng bộ đơn giản hơn, nhưng truyền phát có sẵn nếu bạn cần hiển thị token khi chúng được tạo. ID mô hình vẫn là uncensored bất kể phiên bản SDK.

Tích hợp SDK Node.js

Đối với môi trường JavaScript và TypeScript, SDK Node tuân theo cùng một mẫu. Khởi tạo máy khách với base URL và thông tin xác thực chính xác. Điều này đảm bảo cơ sở mã hiện tại của bạn yêu cầu thay đổi tối thiểu để chuyển nhà cung cấp. ID mô hình uncensored tương thích với tất cả các tham số hoàn thành hội thoại tiêu chuẩn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmmodelsapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

SDK Node.js cũng hỗ trợ mẫu async/await, giúp bạn dễ dàng tích hợp vào các route Express hoặc hàm serverless. Hãy giữ khóa API của bạn trong các biến môi trường để tránh bị lộ không chủ đích. Thiết kế openai compatible api này có nghĩa là bạn có thể chuyển lại sang OpenAI hoặc chuyển sang các nhà cung cấp khác bằng cách chỉ thay đổi đối tượng cấu hình.

Phản hồi truyền phát

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về luồng Sự kiện được máy chủ gửi (SSE), cho phép bạn xử lý token khi chúng được tạo. Điều này giảm độ trễ cảm nhận cho người dùng cuối và rất cần thiết cho các tương tác tác nhân thời gian thực. Định dạng luồng giống hệt với thông số kỹ thuật SSE của OpenAI.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Mỗi phần chứa dữ liệu delta một phần. Bạn phải tích lũy các delta này để tái tạo lại phản hồi đầy đủ. Truyền phát không ảnh hưởng đến giá cả; bạn sẽ được tính phí cho tổng số token đầu vào và đầu ra bất kể chế độ truyền phát. Tính năng này là một phần của thiết kế chat completions api mạnh mẽ mà chúng tôi cung cấp.

Giới hạn, Lỗi và Ngữ cảnh

Cơ sở hạ tầng của chúng tôi áp dụng các giới hạn nghiêm ngặt để đảm bảo độ tin cậy. Bạn bị giới hạn ở 300 yêu cầu mỗi phút trên mỗi khóa, với kích thước tối đa của thân yêu cầu là 8 MB. Cửa sổ ngữ cảnh là 100,000 token, dùng chung giữa prompt và phần hoàn tất. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429. Khóa không hợp lệ trả về 401, và tín dụng không đủ trả về 402. Không giống như nhiều tùy chọn llm api provider khác, chúng tôi không ẩn những giới hạn này; chúng minh bạch và nhất quán. Không có quá trình huấn luyện nào được thực hiện trên dữ liệu của bạn, và quyền riêng tư được duy trì bằng cách không sử dụng prompt để cải thiện mô hình.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.llmmodelsapi.com/v1
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Đầu ra tối đatối đa phần còn lại của cửa sổ 64.000 token; max_tokens tùy chọn (không giới hạn riêng)
Cửa sổ ngữ cảnh64.000 token (đầu vào + đầu ra)
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây
01

Hỏi đáp

Đây có phải là mô hình giống GPT-4 hay Claude không?

Không. Mô hình của chúng tôi là mô hình trọng số mở, được tinh chỉnh đặc biệt cho phản hồi không kiểm duyệt. Đây không phải là GPT, Claude, Gemini hay bất kỳ mô hình nào của nhà cung cấp khác. Đây là một mô hình riêng biệt chạy trên máy chủ GPU của chúng tôi.

Cách tính giá như thế nào?

Chúng tôi sử dụng hệ thống tín dụng trả trước trả theo nhu cầu, không có phí hàng tháng. Token đầu vào giá $0,25 cho mỗi 1 triệu token, và token đầu ra giá $1,00 cho mỗi 1 triệu token. Tín dụng không bao giờ hết hạn, và bạn có thể nạp tiền bằng tiền điện tử (USDT hoặc USDC) bắt đầu từ $10.

Tín dụng dùng thử là gì?

Mọi tài khoản mới đều nhận được $0,50 tín dụng dùng thử có hiệu lực trong 7 ngày. Không cần thẻ tín dụng hoặc số điện thoại để bắt đầu. Điều này cho phép bạn kiểm tra <code>mô hình AI không kiểm duyệt</code> trước khi quyết định mua.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API