IT ▾
Ottieni la chiave API

NSFW di OpenRouter: avvio rapido API LLM senza censura

Inizia a sviluppare con la nostra API LLM dedicata senza censura in pochi minuti. Usa endpoint standard compatibili con OpenAI per inviare testo e ricevere risposte non filtrate senza cambiare modello o filtri nascosti.

Autenticazione

L'autenticazione si basa su una singola chiave API passata nell'intestazione Authorization. Questa chiave viene generata immediatamente dopo che ti sei registrato con email e password nella pagina Ottieni chiave API. Puoi rigenerare la chiave in qualsiasi momento, revocando istantaneamente quella vecchia. L'API non richiede una carta di credito per la prova iniziale e i prompt non vengono utilizzati per addestrare i tuoi dati. Assicurati di memorizzare la chiave in modo sicuro, poiché fornisce accesso diretto al tuo credito prepagato.

Endpoint Chat Completions

Invia richieste all'URL di base https://api.nsfwllmrouter.com/v1 utilizzando l'endpoint standard POST /v1/chat/completions. Questa è un'interfaccia solo testo; non supportiamo embeddings, immagini, audio o generazione video. Specifica il modello come uncensored per assicurarti di utilizzare il nostro modello open-weight dedicato ottimizzato per i contenuti per adulti. Il modello gira sui nostri server GPU e non rifiuta argomenti adulti leciti, di fantasia o controversi. Non è GPT, Claude o il modello di alcun altro fornitore.

curl https://api.nsfwllmrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Il corpo della richiesta non deve superare gli 8 MB. Puoi definire messaggi di sistema, utente e assistente esattamente come faresti con qualsiasi client compatibile con OpenAI. Il modello restituirà l'output di testo direttamente nello stream di risposta.

SDK Python

Usa la libreria ufficiale OpenAI Python per integrarti rapidamente. Indica al client il nostro URL di base e fornisci la tua chiave API. Questo approccio funziona per qualsiasi SDK compatibile con OpenAI, permettendoti di cambiare l'URL di base senza modificare la logica della tua applicazione. L'ID del modello uncensored garantisce che tu stia interagendo con il nostro specifico LLM senza censura.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ricorda che questa è un'API dedicata senza censura, quindi non devi gestire un routing complesso o scegliere tra più modelli. Il sistema gestisce l'inferenza sulla nostra infrastruttura. Se hai bisogno di routing multi-modello, dovrai costruirlo tu stesso, ma qui la scelta è fissa sul nostro singolo modello ottimizzato.

SDK Node.js

Per gli ambienti Node.js, inizializza il client OpenAI con l'URL di base personalizzato e la tua chiave API. Questo ti permette di utilizzare i pattern standard JavaScript/TypeScript per costruire applicazioni AI. Il client comunicherà con i nostri endpoint esattamente come previsto dalla specifica OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assicurati che il tuo ambiente supporti le librerie fetch o http richieste. L'oggetto di risposta conterrà l'array standard choices con il testo generato. Questo metodo è ideale per il rendering lato server o per i backend API dove hai bisogno di una generazione di testo affidabile e non filtrata.

Risposte in streaming

Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) contenenti chunk parziali della risposta. Questo è utile per le interfacce in tempo reale dove vuoi visualizzare il testo man mano che viene generato. Il modello supporta protocolli di streaming standard, quindi puoi utilizzare parser SSE esistenti.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ogni chunk contiene il testo incrementale. Aggrega questi chunk nella tua applicazione per costruire la risposta completa. Lo streaming non influisce sulla fatturazione dei token; vieni addebitato per i token totali di input e output elaborati. Questa funzionalità è supportata sull'endpoint chat/completions.

Limiti di richiesta e vincoli

Ogni chiave API è limitata a 300 richieste al minuto. Se superi questo limite, riceverai un errore di limite di richiesta 429. La dimensione massima del corpo della richiesta è di 8 MB. Se la tua chiave non è valida, riceverai un errore 401. Se non hai credito prepagato, riceverai un errore 402. La finestra di contesto è di 100.000 token, coprendo sia prompt che completamento. Non ci sono garanzie SLA e non offriamo deployment on-premise o routing dei modelli. Usa questa API senza censura per applicazioni che richiedono alto volume e output non filtrato.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllmrouter.com/v1
AutenticazioneAuthorization: Bearer YOUR_KEY
ID modellouncensored
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Modalità JSONresponse_format: {"type": "json_object"}
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Dimensionefino a 8 MB per richiesta
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
Scadenzail credito pagato non scade, nessun abbonamento
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Bonus+5% da $50, +10% da $100
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Sei un rivenditore di OpenRouter?

No, siamo un servizio indipendente che esegue il nostro modello senza censura sui nostri server GPU. Non siamo un partner ufficiale o un rivenditore di OpenRouter, anche se la nostra API è compatibile con OpenAI. Non instradiamo tra i modelli di altri fornitori.

Qual è la dimensione della finestra di contesto?

La finestra di contesto è di 100.000 token, che includono sia il prompt di input che il completamento di output. Questo permette conversazioni lunghe o l'elaborazione di documenti di grandi dimensioni in una singola richiesta.

Supporti la modalità JSON?

Il foglio informativo non elenca esplicitamente la modalità JSON come funzionalità distinta, sebbene il modello possa generare JSON se sollecitato correttamente. Per garanzie specifiche di formattazione, consulta la documentazione del modello o testa con il tuo caso d'uso. Ci concentriamo sulla fornitura della capacità di generazione di testo senza censura.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API