Autenticação
A autenticação depende de uma única chave de API passada no cabeçalho Authorization. Esta chave é gerada imediatamente após você entrar com um e-mail e senha na página Obter chave de API. Você pode regenerar a chave a qualquer momento, o que revoga instantaneamente a antiga. A API não requer cartão de crédito para o teste inicial, e os prompts não são usados para treinar seus dados. Certifique-se de armazenar sua chave com segurança, pois ela fornece acesso direto ao seu crédito pré-pago.
Endpoint de Conclusões de Chat
Envie requisições para a URL base https://api.nsfwllmrouter.com/v1 usando o endpoint padrão POST /v1/chat/completions. Esta é uma interface apenas de texto; não suportamos embeddings, imagens, áudio ou geração de vídeo. Especifique o modelo como uncensored para garantir que está usando nosso modelo de pesos abertos dedicado otimizado para conteúdo adulto. O modelo roda em nossos próprios servidores GPU e não recusa tópicos adultos lícitos, fictícios ou controversos. Não é GPT, Claude ou qualquer outro modelo de fornecedor.
curl https://api.nsfwllmrouter.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
O corpo da requisição não deve exceder 8 MB. Você pode definir mensagens de sistema, usuário e assistente exatamente como faria com qualquer cliente compatível com OpenAI. O modelo retornará texto diretamente no fluxo de resposta.
SDK Python
Use a biblioteca oficial OpenAI Python para integrar rapidamente. Aponte o cliente para nossa URL base e forneça sua chave de API. Esta abordagem funciona para qualquer SDK compatível com OpenAI, permitindo que você altere a URL base sem alterar a lógica do seu aplicativo. O ID do modelo uncensored garante que você está interagindo com nosso LLM sem censura específico.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Lembre-se de que esta é uma API sem censura dedicada, então você não precisa gerenciar roteamento complexo ou selecionar entre vários modelos. O sistema cuida da inferência em nossa infraestrutura. Se você precisar de roteamento multi-modelo, precisará construir isso você mesmo, mas aqui a escolha é fixa para nosso único modelo otimizado.
SDK Node.js
Para ambientes Node.js, inicialize o cliente OpenAI com a URL base personalizada e sua chave de API. Isso permite que você use padrões padrão de JavaScript/TypeScript para construir aplicações de IA. O cliente se comunicará com nossos endpoints exatamente como esperado pela especificação OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Certifique-se de que seu ambiente suporte as bibliotecas fetch ou http necessárias. O objeto de resposta conterá a matriz padrão choices com o texto gerado. Este método é ideal para renderização no lado do servidor ou backends de API onde você precisa de geração de texto confiável e sem filtros.
Respostas em Streaming
Ative o streaming definindo stream: true em sua requisição. A API retorna Eventos Enviados pelo Servidor (SSE) contendo pedaços parciais da resposta. Isso é útil para interfaces em tempo real onde você deseja exibir texto conforme é gerado. O modelo suporta protocolos de streaming padrão, então você pode usar parsers SSE existentes.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Cada chunk contém o texto incremental. Agregue esses chunks em seu aplicativo para construir a resposta completa. O streaming não afeta a cobrança por token; você é cobrado pelos tokens totais de entrada e saída processados. Este recurso é suportado no endpoint chat/completions.
Limites de Requisição e Restrições
Cada chave de API é limitada a 300 requisições por minuto. Se você exceder isso, receberá um erro de limite de requisições 429. O tamanho máximo do corpo da requisição é 8 MB. Se sua chave for inválida, você receberá um erro 401. Se não tiver crédito pré-pago, você receberá um erro 402. A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Não há garantia de SLA, e não oferecemos implantação on-premise ou roteamento de modelos. Use esta api sem censura para aplicações que exigem alto volume e saída sem filtros.