VI ▾
Lấy khóa API

NSFW OpenRouter: Hướng dẫn nhanh API LLM không kiểm duyệt

Bắt đầu xây dựng với API LLM không kiểm duyệt chuyên dụng của chúng tôi trong vài phút. Sử dụng các endpoint tương thích OpenAI tiêu chuẩn để gửi văn bản và nhận phản hồi không bộ lọc mà không cần chuyển đổi mô hình hoặc ẩn bộ lọc.

Xác thực

Xác thực dựa trên một khóa API duy nhất được truyền trong tiêu đề Authorization. Khóa này được tạo ngay sau khi bạn đăng ký bằng email và mật khẩu trên trang Lấy khóa API. Bạn có thể tạo lại khóa bất cứ lúc nào, điều này sẽ thu hồi ngay lập tức khóa cũ. API không yêu cầu thẻ tín dụng cho dùng thử ban đầu, và các prompt không được dùng để huấn luyện dữ liệu của bạn. Hãy đảm bảo lưu trữ khóa của bạn an toàn vì nó cung cấp quyền truy cập trực tiếp vào tín dụng trả trước của bạn.

Endpoint Chat Completions

Gửi yêu cầu đến URL cơ sở https://api.nsfwllmrouter.com/v1 bằng endpoint tiêu chuẩn POST /v1/chat/completions. Đây là giao diện chỉ văn bản; chúng tôi không hỗ trợ embeddings, tạo hình ảnh, âm thanh hoặc video. Chỉ định mô hình là uncensored để đảm bảo bạn đang sử dụng mô hình trọng số mở chuyên dụng của chúng tôi được tối ưu hóa cho nội dung người lớn. Mô hình chạy trên máy chủ GPU của chúng tôi và không từ chối các chủ đề người lớn hợp pháp, hư cấu hoặc gây tranh cãi. Nó không phải là GPT, Claude hay bất kỳ mô hình của nhà cung cấp nào khác.

curl https://api.nsfwllmrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Thân yêu cầu không được vượt quá 8 MB. Bạn có thể xác định các thông điệp hệ thống, người dùng và trợ lý giống như khi sử dụng bất kỳ khách hàng tương thích OpenAI nào. Mô hình sẽ trả về kết quả đầu ra văn bản trực tiếp trong luồng phản hồi.

SDK Python

Sử dụng thư viện Python chính thức của OpenAI để tích hợp nhanh chóng. Chỉ định client trỏ đến URL cơ sở của chúng tôi và cung cấp khóa API của bạn. Cách tiếp cận này hoạt động với bất kỳ SDK tương thích OpenAI nào, cho phép bạn thay đổi URL cơ sở mà không cần thay đổi logic ứng dụng. ID mô hình uncensored đảm bảo bạn đang tương tác với LLM không kiểm duyệt cụ thể của chúng tôi.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Hãy nhớ rằng đây là một API không kiểm duyệt chuyên dụng, vì vậy bạn không cần quản lý định tuyến phức tạp hoặc chọn giữa nhiều mô hình. Hệ thống xử lý suy luận trên cơ sở hạ tầng của chúng tôi. Nếu bạn cần định tuyến đa mô hình, bạn sẽ cần tự xây dựng điều đó, nhưng ở đây lựa chọn được cố định cho mô hình tối ưu hóa đơn lẻ của chúng tôi.

SDK Node.js

Đối với môi trường Node.js, khởi tạo khách hàng OpenAI với URL cơ sở tùy chỉnh và khóa API của bạn. Điều này cho phép bạn sử dụng các mẫu JavaScript/TypeScript tiêu chuẩn để xây dựng ứng dụng AI. Client sẽ giao tiếp với các endpoint của chúng tôi chính xác như dự kiến bởi đặc tả OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Đảm bảo môi trường của bạn hỗ trợ các thư viện fetch hoặc http được yêu cầu. Đối tượng phản hồi sẽ chứa mảng choices tiêu chuẩn với văn bản được tạo. Phương pháp này lý tưởng cho việc hiển thị phía máy chủ hoặc các backend API nơi bạn cần tạo văn bản không bộ lọc đáng tin cậy.

Phản hồi Streaming

Bật streaming bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các sự kiện do máy chủ gửi (SSE) chứa các partial chunks của phản hồi. Điều này hữu ích cho các giao diện thời gian thực nơi bạn muốn hiển thị văn bản khi nó được tạo. Mô hình hỗ trợ các giao thức streaming tiêu chuẩn, vì vậy bạn có thể sử dụng các trình phân tích SSE hiện có.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Mỗi chunk chứa văn bản tăng dần. Tổng hợp các chunk này trong ứng dụng của bạn để construct full response. Streaming không ảnh hưởng đến việc tính phí token; bạn sẽ được tính phí cho tổng số token đầu vào và đầu ra đã xử lý. Tính năng này được hỗ trợ trên endpoint chat/completions.

Giới hạn tốc độ và ràng buộc

Mỗi khóa API bị giới hạn 300 yêu cầu mỗi phút. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Kích thước tối đa của thân yêu cầu là 8 MB. Nếu khóa của bạn không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu bạn không có tín dụng trả trước, bạn sẽ nhận được lỗi 402. Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt và output completion. Không có đảm bảo SLA, và chúng tôi không cung cấp triển khai on-prem hoặc định tuyến mô hình. Sử dụng api không kiểm duyệt này cho các ứng dụng yêu cầu khối lượng lớn và output không lọc.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllmrouter.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Đây có phải là nhà bán lại OpenRouter không?

Không, chúng tôi là dịch vụ độc lập chạy mô hình không kiểm duyệt của riêng mình trên máy chủ GPU của chúng tôi. Chúng tôi không phải đối tác hoặc nhà bán lại chính thức của OpenRouter, dù API của chúng tôi tương thích OpenAI. Chúng tôi không định tuyến giữa các mô hình của nhà cung cấp khác.

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt đầu vào và kết quả đầu ra. Điều này cho phép các cuộc hội thoại dài hoặc xử lý tài liệu lớn trong một yêu cầu duy nhất.

Bạn có hỗ trợ chế độ JSON không?

Bảng thông số không liệt kê rõ ràng chế độ JSON như một tính năng riêng biệt, dù mô hình có thể xuất JSON nếu được prompt đúng. Để có đảm bảo định dạng cụ thể, hãy kiểm tra tài liệu mô hình hoặc thử nghiệm với trường hợp sử dụng của bạn. Chúng tôi tập trung vào việc cung cấp khả năng tạo văn bản không kiểm duyệt.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.

Lấy khóa API