Xác thực
Xác thực dựa trên một khóa API duy nhất được truyền trong tiêu đề Authorization. Khóa này được tạo ngay sau khi bạn đăng ký bằng email và mật khẩu trên trang Lấy khóa API. Bạn có thể tạo lại khóa bất cứ lúc nào, điều này sẽ thu hồi ngay lập tức khóa cũ. API không yêu cầu thẻ tín dụng cho dùng thử ban đầu, và các prompt không được dùng để huấn luyện dữ liệu của bạn. Hãy đảm bảo lưu trữ khóa của bạn an toàn vì nó cung cấp quyền truy cập trực tiếp vào tín dụng trả trước của bạn.
Endpoint Chat Completions
Gửi yêu cầu đến URL cơ sở https://api.nsfwllmrouter.com/v1 bằng endpoint tiêu chuẩn POST /v1/chat/completions. Đây là giao diện chỉ văn bản; chúng tôi không hỗ trợ embeddings, tạo hình ảnh, âm thanh hoặc video. Chỉ định mô hình là uncensored để đảm bảo bạn đang sử dụng mô hình trọng số mở chuyên dụng của chúng tôi được tối ưu hóa cho nội dung người lớn. Mô hình chạy trên máy chủ GPU của chúng tôi và không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Nó không phải là GPT, Claude hay bất kỳ mô hình của nhà cung cấp nào khác.
curl https://api.nsfwllmrouter.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Thân yêu cầu không được vượt quá 8 MB. Bạn có thể xác định các thông điệp hệ thống, người dùng và trợ lý giống như khi sử dụng bất kỳ khách hàng tương thích OpenAI nào. Mô hình sẽ trả về kết quả đầu ra văn bản trực tiếp trong luồng phản hồi.
SDK Python
Sử dụng thư viện Python chính thức của OpenAI để tích hợp nhanh chóng. Chỉ định client trỏ đến URL cơ sở của chúng tôi và cung cấp khóa API của bạn. Cách tiếp cận này hoạt động với bất kỳ SDK tương thích OpenAI nào, cho phép bạn thay đổi URL cơ sở mà không cần thay đổi logic ứng dụng. ID mô hình uncensored đảm bảo bạn đang tương tác với LLM không kiểm duyệt cụ thể của chúng tôi.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Hãy nhớ rằng đây là một API không kiểm duyệt chuyên dụng, vì vậy bạn không cần quản lý định tuyến phức tạp hoặc chọn giữa nhiều mô hình. Hệ thống xử lý suy luận trên cơ sở hạ tầng của chúng tôi. Nếu bạn cần định tuyến đa mô hình, bạn sẽ cần tự xây dựng điều đó, nhưng ở đây lựa chọn được cố định cho mô hình tối ưu hóa đơn lẻ của chúng tôi.
SDK Node.js
Đối với môi trường Node.js, khởi tạo khách hàng OpenAI với URL cơ sở tùy chỉnh và khóa API của bạn. Điều này cho phép bạn sử dụng các mẫu JavaScript/TypeScript tiêu chuẩn để xây dựng ứng dụng AI. Client sẽ giao tiếp với các endpoint của chúng tôi chính xác như dự kiến bởi đặc tả OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Đảm bảo môi trường của bạn hỗ trợ các thư viện fetch hoặc http được yêu cầu. Đối tượng phản hồi sẽ chứa mảng choices tiêu chuẩn với văn bản được tạo. Phương pháp này lý tưởng cho việc hiển thị phía máy chủ hoặc các backend API nơi bạn cần tạo văn bản không bộ lọc đáng tin cậy.
Phản hồi Streaming
Bật streaming bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các sự kiện do máy chủ gửi (SSE) chứa các partial chunks của phản hồi. Điều này hữu ích cho các giao diện thời gian thực nơi bạn muốn hiển thị văn bản khi nó được tạo. Mô hình hỗ trợ các giao thức streaming tiêu chuẩn, vì vậy bạn có thể sử dụng các trình phân tích SSE hiện có.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Mỗi chunk chứa văn bản tăng dần. Tổng hợp các chunk này trong ứng dụng của bạn để construct full response. Streaming không ảnh hưởng đến việc tính phí token; bạn sẽ được tính phí cho tổng số token đầu vào và đầu ra đã xử lý. Tính năng này được hỗ trợ trên endpoint chat/completions.
Giới hạn tốc độ và ràng buộc
Mỗi khóa API bị giới hạn 300 yêu cầu mỗi phút. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Kích thước tối đa của thân yêu cầu là 8 MB. Nếu khóa của bạn không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu bạn không có tín dụng trả trước, bạn sẽ nhận được lỗi 402. Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt và output completion. Không có đảm bảo SLA, và chúng tôi không cung cấp triển khai on-prem hoặc định tuyến mô hình. Sử dụng api không kiểm duyệt này cho các ứng dụng yêu cầu khối lượng lớn và output không lọc.