PL ▾
Pobierz klucz API

OpenRouter NSFW: Szybki start API niecenzurowanego LLM

Zacznij budować z naszym dedykowanym API LLM bez cenzury w kilka minut. Używaj standardowych endpointów kompatybilnych z OpenAI, aby wysyłać tekst i odbierać odpowiedzi bez filtrów, bez zmiany modeli ani ukrytych ograniczeń.

Uwierzytelnianie

Uwierzytelnianie opiera się na jednym kluczu API przekazanym w nagłówku Authorization. Klucz ten jest generowany natychmiast po zalogowaniu się na stronę Pobierz klucz API przy użyciu adresu e-mail i hasła. Możesz wygenerować klucz ponownie w dowolnym momencie, co natychmiast unieważnia poprzedni. API nie wymaga karty kredytowej do początkowego okresu próbnego, a prompty nie są używane do trenowania Twoich danych. Upewnij się, że bezpiecznie przechowywany jest Twój klucz API, ponieważ zapewnia on bezpośredni dostęp do przedpłaconego kredytu.

Endpoint Chat Completions

Wysyłaj zapytania pod bazowy adres URL https://api.nsfwllmrouter.com/v1, korzystając ze standardowego endpointu POST /v1/chat/completions. Jest to interfejs wyłącznie tekstowy; nie obsługujemy embeddingów, obrazów, audio ani generowania wideo. Wskaż model jako uncensored, aby upewnić się, że korzystasz z naszego dedykowanego modelu o otwartych wagach zoptymalizowanego pod kątem treści dla dorosłych. Model działa na naszych własnych serwerach GPU i nie odrzuca legalnych treści dla dorosłych, fikcyjnych lub kontrowersyjnych. Nie jest to GPT, Claude ani żaden inny model dostawcy.

curl https://api.nsfwllmrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Treść zapytania nie może przekraczać 8 MB. Możesz zdefiniować wiadomości systemowe, od użytkownika i asystenta tak samo, jak w przypadku dowolnego klienta kompatybilnego z OpenAI. Model zwróci wynik tekstowy bezpośrednio w strumieniu odpowiedzi.

SDK Python

Użyj oficjalnej biblioteki OpenAI dla Pythona, aby szybko zintegrować się z API. Wskaż klientowi nasz bazowy adres URL i podaj swój klucz API. To podejście działa z dowolnym SDK kompatybilnym z OpenAI, pozwalając na zmianę bazowego adresu URL bez zmiany logiki aplikacji. ID modelu uncensored zapewnia, że wchodzisz w interakcję z naszym konkretnym niecenzurowanym LLM.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pamiętaj, że jest to dedykowane API bez cenzury, więc nie musisz zarządzać złożonym trasowaniem ani wybierać między wieloma modelami. System obsługuje wnioskowanie na naszej infrastrukturze. Jeśli potrzebujesz trasowania między wieloma modelami, musisz zbudować to samodzielnie, ale tutaj wybór jest stały i ograniczony do naszego jednego zoptymalizowanego modelu.

SDK Node.js

W środowisku Node.js zainicjuj klienta OpenAI podając niestandardowy URL bazowy i klucz API. Pozwala to na użycie standardowych wzorców JavaScript/TypeScript do budowania aplikacji AI. Klient będzie komunikował się z naszymi endpointami zgodnie ze specyfikacją OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Upewnij się, że twoje środowisko obsługuje wymagane biblioteki fetch lub http. Obiekt odpowiedzi będzie zawierał standardową tablicę choices z wygenerowanym tekstem. Ta metoda jest idealna do renderowania po stronie serwera lub backendów API, gdzie potrzebujesz niezawodnego generowania tekstu bez filtrów.

Strumieniowanie odpowiedzi

Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. API zwraca zdarzenia wysłane przez serwer (SSE) zawierające częściowe fragmenty odpowiedzi. Jest to przydatne w interfejsach czasu rzeczywistego, gdzie chcesz wyświetlać tekst w miarę jego generowania. Model obsługuje standardowe protokoły strumieniowania, więc możesz użyć istniejących parserów SSE.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Każdy fragment zawiera inkrementalny tekst. Agreguj te fragmenty w swojej aplikacji, aby zbudować pełną odpowiedź. Strumieniowanie nie wpływa na rozliczanie tokenów; płacisz za całkowitą liczbę tokenów wejściowych i wyjściowych przetworzonych przez system. Ta funkcja jest obsługiwana na endpointzie chat/completions.

Limity zapytań i ograniczenia

Każdy klucz API jest ograniczony do 300 zapytań na minutę. Jeśli przekroczysz ten limit, otrzymasz błąd limitu zapytań 429. Maksymalny rozmiar treści zapytania wynosi 8 MB. Jeśli twój klucz jest nieprawidłowy, otrzymasz błąd 401. Jeśli nie masz przedpłaconego kredytu, otrzymasz błąd 402. Okno kontekstu wynosi 100 000 tokenów, obejmując zarówno prompt, jak i uzupełnienie. Nie ma gwarancji SLA, a my nie oferujemy wdrożenia on-premise ani trasowania modeli. Używaj tego API bez cenzury dla aplikacji wymagających dużej liczby zapytań i odpowiedzi bez filtrów.

Specyfikacja techniczna

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllmrouter.com/v1
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Równoległe zapytaniado 8 jednocześnie na klucz
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Czy jesteście resellerem OpenRouter?

Nie, jesteśmy niezależną usługą uruchamiającą nasz własny model bez cenzury na własnych serwerach GPU. Nie jesteśmy oficjalnym partnerem ani resellerem OpenRouter, choć nasze API jest kompatybilne z OpenAI. Nie przesyłamy zapytań między modelami innych dostawców.

Jaki jest rozmiar okna kontekstu?

Okno kontekstu wynosi 100 000 tokenów, co obejmuje zarówno prompt wejściowy, jak i generowane uzupełnienie. Pozwala to na długie rozmowy lub przetwarzanie dużych dokumentów w ramach jednego zapytania.

Czy obsługujecie tryb JSON?

Karta modelu nie wymienia wyraźnie trybu JSON jako oddzielnej funkcji, choć model może generować JSON, jeśli zostanie poprawnie poproszony. Aby uzyskać gwarancje formatowania, sprawdź dokumentację modelu lub przetestuj go w swoim przypadku użycia. Skupiamy się na dostarczaniu możliwości generowania tekstu bez cenzury.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień bazowy adres URL. To cała konfiguracja.

Pobierz klucz API