认证
认证依赖于通过 Authorization 头传递的单个 API 密钥。该密钥在通过电子邮件和密码在 获取 API 密钥 页面注册后立即生成。你可以随时重新生成密钥,这将立即撤销旧密钥。API 初始试用不需要信用卡,且提示词不会用于训练你的数据。请确保妥善保管密钥,因为它可直接访问你的预付额度。
聊天补全接口
向基础 URL https://api.nsfwllmrouter.com/v1 发送请求,使用标准的 POST /v1/chat/completions 接口。这是一个纯文本接口;我们不支持嵌入、图像、音频或视频生成。将模型指定为 uncensored,以确保使用我们专为成人内容优化的开放权重模型。该模型运行在我们自己的 GPU 服务器上,不会拒绝合法的成人、虚构或争议性话题。它不是 GPT、Claude 或任何其他供应商的模型。
curl https://api.nsfwllmrouter.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
请求体不得超过 8 MB。您可以像使用任何兼容 OpenAI 的客户端一样定义系统、用户和助手消息。模型将在响应流中直接返回文本输出。
Python SDK
使用官方 OpenAI Python 库快速集成。将客户端指向我们的基础 URL 并提供您的 API 密钥。此方法适用于任何兼容 OpenAI 的 SDK,允许您在不更改应用程序逻辑的情况下交换基础 URL。uncensored 模型 ID 确保您正在与我们特定的无审查 LLM 进行交互。
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllmrouter.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
请记住,这是一个专用的无审查 API,因此您无需管理复杂的路由或在多个模型之间进行选择。系统在自有基础设施上处理推理。如果您需要多模型路由,则需要自行构建,但在这里选择固定为我们单一的优化模型。
Node SDK
对于 Node.js 环境,使用自定义基础 URL 和 API 密钥初始化 OpenAI 客户端。这允许您使用标准的 JavaScript/TypeScript 模式构建 AI 应用程序。客户端将完全按照 OpenAI 规范预期的方式与我们的接口通信。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllmrouter.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
确保您的环境支持所需的 fetch 或 http 库。响应对象将包含包含生成文本的标准 choices 数组。此方法非常适合需要可靠、无过滤文本生成的服务器端渲染或 API 后端。
流式响应
通过在请求中设置 stream: true 启用流式输出。API 返回包含响应部分块的服务器发送事件 (SSE)。这对于您希望实时显示生成文本的界面非常有用。模型支持标准流式传输协议,因此您可以使用现有的 SSE 解析器。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
每个块包含增量文本。在应用程序中聚合这些块以构建完整响应。流式传输不影响 token 计费;您为处理的总输入和输出 token 付费。此功能在 chat/completions 接口上受支持。
速率限制和约束
每个 API 密钥限制为每分钟 300 个请求。如果超过此限制,您将收到 429 速率限制错误。最大请求体大小为 8 MB。如果密钥无效,您将收到 401 错误。如果没有预付额度,您将收到 402 错误。上下文窗口为 100,000 token,涵盖提示词和补全。没有 SLA 保证,我们不提供本地部署或模型路由。将此无审查 API 用于需要高吞吐量和无过滤输出的应用程序。