Autenticazione
L'autenticazione si basa su una singola chiave API passata nell'intestazione Authorization. Questa chiave viene generata immediatamente dopo che ti sei registrato con email e password nella pagina Ottieni chiave API. Puoi rigenerare la chiave in qualsiasi momento, revocando istantaneamente quella vecchia. L'API non richiede una carta di credito per la prova iniziale e i prompt non vengono utilizzati per addestrare i tuoi dati. Assicurati di memorizzare la chiave in modo sicuro, poiché fornisce accesso diretto al tuo credito prepagato.
Endpoint Chat Completions
Invia richieste all'URL di base https://api.nsfwllmrouter.com/v1 utilizzando l'endpoint standard POST /v1/chat/completions. Questa è un'interfaccia solo testo; non supportiamo embeddings, immagini, audio o generazione video. Specifica il modello come uncensored per assicurarti di utilizzare il nostro modello open-weight dedicato ottimizzato per i contenuti per adulti. Il modello gira sui nostri server GPU e non rifiuta argomenti adulti leciti, di fantasia o controversi. Non è GPT, Claude o il modello di alcun altro fornitore.
curl https://api.nsfwllmrouter.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Il corpo della richiesta non deve superare gli 8 MB. Puoi definire messaggi di sistema, utente e assistente esattamente come faresti con qualsiasi client compatibile con OpenAI. Il modello restituirà l'output di testo direttamente nello stream di risposta.
SDK Python
Usa la libreria ufficiale OpenAI Python per integrarti rapidamente. Indica al client il nostro URL di base e fornisci la tua chiave API. Questo approccio funziona per qualsiasi SDK compatibile con OpenAI, permettendoti di cambiare l'URL di base senza modificare la logica della tua applicazione. L'ID del modello uncensored garantisce che tu stia interagendo con il nostro specifico LLM senza censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ricorda che questa è un'API dedicata senza censura, quindi non devi gestire un routing complesso o scegliere tra più modelli. Il sistema gestisce l'inferenza sulla nostra infrastruttura. Se hai bisogno di routing multi-modello, dovrai costruirlo tu stesso, ma qui la scelta è fissa sul nostro singolo modello ottimizzato.
SDK Node.js
Per gli ambienti Node.js, inizializza il client OpenAI con l'URL di base personalizzato e la tua chiave API. Questo ti permette di utilizzare i pattern standard JavaScript/TypeScript per costruire applicazioni AI. Il client comunicherà con i nostri endpoint esattamente come previsto dalla specifica OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Assicurati che il tuo ambiente supporti le librerie fetch o http richieste. L'oggetto di risposta conterrà l'array standard choices con il testo generato. Questo metodo è ideale per il rendering lato server o per i backend API dove hai bisogno di una generazione di testo affidabile e non filtrata.
Risposte in streaming
Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) contenenti chunk parziali della risposta. Questo è utile per le interfacce in tempo reale dove vuoi visualizzare il testo man mano che viene generato. Il modello supporta protocolli di streaming standard, quindi puoi utilizzare parser SSE esistenti.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ogni chunk contiene il testo incrementale. Aggrega questi chunk nella tua applicazione per costruire la risposta completa. Lo streaming non influisce sulla fatturazione dei token; vieni addebitato per i token totali di input e output elaborati. Questa funzionalità è supportata sull'endpoint chat/completions.
Limiti di richiesta e vincoli
Ogni chiave API è limitata a 300 richieste al minuto. Se superi questo limite, riceverai un errore di limite di richiesta 429. La dimensione massima del corpo della richiesta è di 8 MB. Se la tua chiave non è valida, riceverai un errore 401. Se non hai credito prepagato, riceverai un errore 402. La finestra di contesto è di 100.000 token, coprendo sia prompt che completamento. Non ci sono garanzie SLA e non offriamo deployment on-premise o routing dei modelli. Usa questa API senza censura per applicazioni che richiedono alto volume e output non filtrato.