FR ▾
Obtenir une clé API

OpenRouter NSFW : Guide de démarrage rapide de l'API LLM sans censure

Commencez à développer avec notre API LLM sans censure dédiée en quelques minutes. Utilisez des endpoints standard compatibles OpenAI pour envoyer du texte et recevoir des réponses non filtrées sans changer de modèle ni gérer de filtres cachés.

Authentification

L'authentification repose sur une seule clé API passée dans l'en-tête Authorization. Cette clé est générée immédiatement après votre inscription avec un e-mail et un mot de passe sur la page Obtenir la clé API. Vous pouvez régénérer la clé à tout moment, ce qui révoque instantanément l'ancienne. L'API ne nécessite pas de carte bancaire pour l'essai initial, et les prompts ne sont pas utilisés pour l'entraînement de vos données. Assurez-vous de stocker votre clé en toute sécurité, car elle donne un accès direct à votre crédit prépayé.

Endpoint de complétions de chat

Envoyez des requêtes à l'URL de base https://api.nsfwllmrouter.com/v1 en utilisant l'endpoint standard POST /v1/chat/completions. Il s'agit d'une interface textuelle uniquement ; nous ne prenons pas en charge les embeddings, les images, l'audio ou la génération vidéo. Spécifiez le modèle comme uncensored pour vous assurer d'utiliser notre modèle à poids ouverts dédié optimisé pour le contenu adulte. Le modèle s'exécute sur nos propres serveurs GPU et ne refuse pas les sujets licites pour adultes, fictifs ou controversés. Il ne s'agit pas de GPT, Claude ou de tout autre modèle d'un autre fournisseur.

curl https://api.nsfwllmrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Le corps de la requête ne doit pas dépasser 8 Mo. Vous pouvez définir les messages système, utilisateur et assistant exactement comme vous le feriez avec n'importe quel client compatible OpenAI. Le modèle renverra le texte de sortie directement dans le flux de réponse.

SDK Python

Utilisez la bibliothèque officielle OpenAI Python pour une intégration rapide. Pointez le client vers notre URL de base et fournissez votre clé API. Cette approche fonctionne pour tout SDK compatible OpenAI, vous permettant de changer l'URL de base sans modifier la logique de votre application. L'ID de modèle uncensored garantit que vous interagissez avec notre LLM sans censure spécifique.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

N'oubliez pas qu'il s'agit d'une API sans censure dédiée, vous n'avez donc pas besoin de gérer un routage complexe ou de choisir entre plusieurs modèles. Le système gère l'inférence sur notre infrastructure. Si vous avez besoin d'un routage multi-modèles, vous devrez le construire vous-même, mais ici le choix est fixe sur notre modèle unique optimisé.

SDK Node.js

Pour les environnements Node.js, initialisez le client OpenAI avec l’URL de base personnalisée et votre clé API. Cela vous permet d’utiliser les modèles JavaScript/TypeScript standards pour créer des applications IA. Le client communiquera avec nos endpoints exactement comme l’exige la spécification OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Assurez-vous que votre environnement prend en charge les bibliothèques fetch ou http requises. L'objet de réponse contiendra le tableau standard choices avec le texte généré. Cette méthode est idéale pour le rendu côté serveur ou les backends API où vous avez besoin d'une génération de texte fiable et sans filtre.

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des Server-Sent Events (SSE) contenant des fragments partiels de la réponse. Cela est utile pour les interfaces en temps réel où vous souhaitez afficher le texte au fur et à mesure de sa génération. Le modèle prend en charge les protocoles de streaming standard, vous pouvez donc utiliser des analyseurs SSE existants.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Chaque fragment contient le texte partiel. Agrégez ces fragments dans votre application pour construire la réponse complète. Le streaming n'affecte pas la facturation par token ; vous êtes facturé pour le total des tokens d'entrée et de sortie traités. Cette fonctionnalité est prise en charge sur l'endpoint chat/completions.

Limites de débit et contraintes

Chaque clé API est limitée à 300 requêtes par minute. Si vous dépassez ce seuil, vous recevrez une erreur de limite de débit 429. La taille maximale du corps de la requête est de 8 Mo. Si votre clé n’est pas valide, vous obtiendrez une erreur 401. Si vous n’avez pas de crédit prépayé, vous recevrez une erreur 402. La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. Il n’y a pas de garantie SLA, et nous ne proposons pas de déploiement sur site ni de routage de modèles. Utilisez cette API sans censure pour des applications nécessitant un fort volume et des sorties non filtrées.

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllmrouter.com/v1
AuthentificationAuthorization: Bearer YOUR_KEY
ID du modèleuncensored
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Fenêtre de contexte100 000 tokens (entrée + sortie)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Taillejusqu'à 8 Mo par requête
Limite de débit300 requêtes par minute et par clé
Concurrence8 requêtes simultanées par clé
Validitéle crédit payé n'expire jamais, sans abonnement
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Bonus+5 % dès 50 $, +10 % dès 100 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

S'agit-il d'un revendeur OpenRouter ?

Non, nous sommes un service indépendant exécutant notre propre modèle sans censure sur nos propres serveurs GPU. Nous ne sommes ni un partenaire officiel ni un revendeur d'OpenRouter, bien que notre API soit compatible OpenAI. Nous n'assurons pas de routage entre les modèles d'autres fournisseurs.

Quelle est la taille de la fenêtre de contexte ?

La fenêtre de contexte est de 100 000 tokens, ce qui inclut à la fois le prompt d'entrée et la complétion de sortie. Cela permet des conversations longues ou le traitement de gros documents au sein d'une seule requête.

Proposez-vous le mode JSON ?

La fiche technique ne liste pas explicitement le mode JSON comme une fonctionnalité distincte, bien que le modèle puisse générer du JSON si le prompt est correct. Pour des garanties de formatage spécifiques, consultez la documentation du modèle ou testez avec votre cas d'usage. Nous nous concentrons sur la fourniture de la capacité de génération de texte sans censure.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.

Obtenir une clé API