Autentikasi
Autentikasi mengandalkan satu Authorization kunci API yang diteruskan dalam header. Kunci ini dibuat segera setelah Anda masuk dengan email dan sandi di halaman Dapatkan kunci API. Anda dapat membuat ulang kunci kapan saja, yang secara langsung mencabut kunci lama. API tidak memerlukan kartu kredit untuk uji coba awal, dan prompt tidak digunakan untuk melatih data Anda. Pastikan Anda menyimpan kunci dengan aman, karena kunci ini memberikan akses langsung ke saldo prabayar Anda.
Endpoint Penyelesaian Obrolan
Kirim permintaan ke URL dasar https://api.nsfwllmrouter.com/v1 menggunakan endpoint POST /v1/chat/completions standar. Ini adalah antarmuka teks saja; kami tidak mendukung embedding, gambar, audio, atau generasi video. Tentukan model sebagai uncensored untuk memastikan Anda menggunakan model bobot terbuka kami yang dioptimalkan untuk konten dewasa. Model ini berjalan di server GPU kami sendiri dan tidak menolak topik dewasa, fiksi, atau kontroversial yang sah. Ini bukan GPT, Claude, atau model vendor lain.
curl https://api.nsfwllmrouter.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Isi permintaan tidak boleh melebihi 8 MB. Anda dapat menentukan pesan sistem, pengguna, dan asisten seperti yang Anda lakukan dengan klien kompatibel OpenAI apa pun. Model akan mengembalikan output teks langsung di aliran respons.
SDK Python
Gunakan pustaka Python OpenAI resmi untuk integrasi cepat. Arahkan klien ke URL dasar kami dan berikan kunci API Anda. Pendekatan ini berfungsi untuk SDK kompatibel OpenAI apa pun, memungkinkan Anda mengganti URL dasar tanpa mengubah logika aplikasi Anda. ID model uncensored memastikan Anda berinteraksi dengan LLM tanpa sensor khusus kami.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ingatlah bahwa ini adalah api tanpa sensor khusus, sehingga Anda tidak perlu mengelola routing kompleks atau memilih di antara beberapa model. Sistem menangani inferensi di infrastruktur kami. Jika Anda memerlukan routing multi-model, Anda harus membuatnya sendiri, tetapi di sini pilihannya tetap pada model tunggal yang dioptimalkan kami.
SDK Node
Untuk lingkungan Node.js, inisialisasi klien OpenAI dengan URL dasar kustom dan kunci API Anda. Ini memungkinkan Anda menggunakan pola JavaScript/TypeScript standar untuk membangun aplikasi AI. Klien akan berkomunikasi dengan endpoint kami persis seperti yang diharapkan oleh spesifikasi OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Pastikan lingkungan Anda mendukung pustaka fetch atau http yang diperlukan. Objek respons akan berisi array choices standar dengan teks yang dihasilkan. Metode ini sangat ideal untuk rendering sisi server atau backend API di mana Anda memerlukan generasi teks yang dapat diandalkan dan tanpa filter.
Respons Streaming
Aktifkan streaming dengan mengatur stream: true dalam permintaan Anda. API mengembalikan Server-Sent Events (SSE) yang berisi potongan respons parsial. Ini berguna untuk antarmuka waktu nyata di mana Anda ingin menampilkan teks saat teks tersebut dihasilkan. Model mendukung protokol streaming standar, sehingga Anda dapat menggunakan parser SSE yang ada.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Setiap potongan berisi teks inkremental. Akumulasi potongan-potongan ini dalam aplikasi Anda untuk membangun respons lengkap. Streaming tidak memengaruhi penagihan token; Anda dibebankan untuk total token masukan dan output yang diproses. Fitur ini didukung di endpoint chat/completions.
Batas Laju dan Kendala
Setiap kunci API dibatasi hingga 300 permintaan per menit. Jika Anda melebihi ini, Anda akan menerima kesalahan batas laju 429. Ukuran badan permintaan maksimum adalah 8 MB. Jika kunci Anda tidak valid, Anda akan mendapatkan kesalahan 401. Jika Anda tidak memiliki saldo prabayar, Anda akan menerima kesalahan 402. Jendela konteks adalah 100.000 token, mencakup prompt dan penyelesaian. Tidak ada jaminan SLA, dan kami tidak menawarkan penyebaran on-prem atau routing model. Gunakan api tanpa sensor ini untuk aplikasi yang membutuhkan volume tinggi dan output tanpa filter.