NL ▾
API-sleutel aanvragen

OpenRouter NSFW: Snelle start ongecensureerde LLM-API

Begin binnen minuten met bouwen met onze speciale ongecensureerde LLM-API. Gebruik standaard OpenAI-compatibele endpoints om tekst te versturen en ongefilterde antwoorden te ontvangen zonder model-hopping of verborgen filters.

Authenticatie

Authenticatie is afhankelijk van een enkele API-sleutel die wordt doorgegeven in de Authorization-header. Deze sleutel wordt direct gegenereerd nadat je je hebt aangemeld met een e-mailadres en wachtwoord op de API-sleutel ophalen-pagina. Je kunt de sleutel op elk moment opnieuw genereren, waardoor de oude sleutel onmiddellijk ongeldig wordt. Voor de initiële proefversie is geen creditcard vereist en worden prompts niet gebruikt om je gegevens te trainen. Zorg ervoor dat je de sleutel veilig bewaart, omdat deze directe toegang geeft tot je prepaid tegoed.

Chat Completions Endpoint

Verstuur verzoeken naar de basis-URL https://api.nsfwllmrouter.com/v1 met behulp van het standaard POST /v1/chat/completions-endpoint. Dit is een tekstinterface; we ondersteunen geen embeddings, afbeeldingen, audio of video-generatie. Geef het model op als uncensored om zeker te weten dat je ons speciale open-weight model gebruikt dat is geoptimaliseerd voor volwassen inhoud. Het model draait op onze eigen GPU-servers en weigert geen wettelijke volwassen, fictieve of controversiële onderwerpen. Het is geen GPT, Claude of een model van een andere leverancier.

curl https://api.nsfwllmrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

De verzoekbody mag niet groter zijn dan 8 MB. Je kunt systeem-, gebruiker- en assistentberichten definiëren zoals je dat zou doen met elke OpenAI-compatibele client. Het model retourneert tekstuitvoer direct in de responsstream.

Python SDK

Gebruik de officiële OpenAI Python-bibliotheek voor snelle integratie. Wijs de client naar onze basis-URL en geef je API-sleutel op. Deze aanpak werkt voor elke OpenAI-compatibele SDK, zodat je de basis-URL kunt wijzigen zonder je applicatielogica aan te passen. De model-ID uncensored zorgt ervoor dat je communiceert met onze specifieke ongecensureerde LLM.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Onthoud dat dit een speciale ongecensureerde API is, dus je hoeft geen complexe routing te beheren of te kiezen tussen meerdere modellen. Het systeem verwerkt de inferentie op onze infrastructuur. Als je multi-model routing nodig hebt, moet je dat zelf bouwen, maar hier is de keuze vastgesteld aan ons enkele geoptimaliseerde model.

Node SDK

Initialiseer voor Node.js-omgevingen de OpenAI-client met de aangepaste basis-URL en je API-sleutel. Hiermee kun je standaard JavaScript/TypeScript-patronen gebruiken voor het bouwen van AI-applicaties. De client communiceert met onze endpoints precies zoals verwacht door de OpenAI-specificatie.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Zorg ervoor dat je omgeving de vereiste fetch- of http-bibliotheken ondersteunt. Het responsobject bevat de standaard choices-array met de gegenereerde tekst. Deze methode is ideaal voor server-side rendering of API-backends waar je betrouwbare, ongefilterde tekstgeneratie nodig hebt.

Streaming Responses

Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert Server-Sent Events (SSE) met gedeeltelijke brokken van het antwoord. Dit is handig voor realtime-interfaces waar je tekst wilt weergeven terwijl deze wordt gegenereerd. Het model ondersteunt standaard streaming-protocollen, dus je kunt bestaande SSE-parsers gebruiken.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Elke brok bevat de incrementele tekst. Aggregateer deze brokken in je applicatie om de volledige respons samen te stellen. Streaming heeft geen invloed op de tokenfacturatie; je wordt gefactureerd voor het totale aantal verwerkte input- en outputtokens. Deze functie wordt ondersteund op het chat/completions-endpoint.

Rate Limits and Constraints

Elke API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 rate limit-fout. De maximale grootte van de request body is 8 MB. Als je sleutel ongeldig is, krijg je een 401 fout. Als je geen prepaid tegoed hebt, ontvang je een 402 fout. Het contextvenster is 100.000 tokens, zowel voor de prompt als de completion. Er is geen SLA-garantie en wij bieden geen on-prem deployment of model routing. Gebruik deze ongecensureerde API voor applicaties die hoge volumes en ongefilterde output vereisen.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllmrouter.com/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
Model-IDuncensored
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Verzoekgroottetot 8 MB
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Geldigheidbetaald tegoed verloopt niet, geen abonnement
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Bonus+5% vanaf $50, +10% vanaf $100
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Ben jij een OpenRouter-verkooppartner?

Nee, wij zijn een onafhankelijke dienst die ons eigen ongecensureerde model draait op onze eigen GPU-servers. Wij zijn geen officiële partner of doorverkoper van OpenRouter, hoewel onze API OpenAI-compatible is. We routeren niet tussen modellen van andere aanbieders.

Wat is de grootte van het contextvenster?

Het contextvenster is 100.000 tokens, inclusief zowel de input prompt als de output completion. Dit maakt lange gesprekken of de verwerking van grote documenten binnen één verzoek mogelijk.

Ondersteun je JSON-modus?

De factsheet noemt JSON-modus niet expliciet als een apart kenmerk, hoewel het model JSON kan uitvoeren als je dit goed promptt. Voor specifieke formatteergaranties raadpleeg je de documentatie van het model of test je met je toepassing. We richten ons op het bieden van ongecensureerde tekstgeneratie.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele installatie.

API-sleutel aanvragen