Basis-URL & Authenticatie
De API werkt op https://api.nsfwchatbot.cc/v1. Het gebruikt standaard Bearer token-authenticatie. Je verkrijgt één API-sleutel via de pagina API-sleutel verkrijgen, met ondersteuning voor aanmelding via Google of e-mail. De sleutel moet worden verzonden in de Authorization header. Er is slechts één sleutel actief per account; het genereren van een nieuwe sleutel intrekt de vorige. Er zijn geen maandelijkse abonnementen—tegoed is prepaid en verloopt nooit.
Zorg ervoor dat je clientbibliotheek naar de bovenstaande basis-URL wijst. De modelidentifier is altijd uncensored. Dit is een open-weight model getuned voor minimale inhoudsweigering, verschillend van GPT of Claude. Het levert ruwe tekstantwoorden zonder algemene guardrails voor wettelijk volwassen inhoud.
Eerste verzoek
Een basisverzoek lijkt op het OpenAI chat-completions endpoint. Je specificeert het model, berichten en optionele parameters. De API retourneert een tekstantwoord. Als je max_tokens weglaat, is de standaard uitvoerlimiet 2.048 tokens. Het contextvenster ondersteunt maximaal 100.000 tokens totaal voor prompt en completion samen.
Het volgende voorbeeld toont een standaard tekstcompletieverzoek met curl.
curl https://api.nsfwchatbot.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Dit retourneert een JSON-object met de gegenereerde tekst. Fouten retourneren standaard HTTP-statuscodes met een foutobject in de body.
Python SDK
Gebruik de officiële OpenAI Python-bibliotheek, configureer deze zodat deze naar onze basis-URL wijst. Hiermee kun je bestaande clientcode met minimale wijzigingen gebruiken. Geef je API-sleutel door als api_key en stel base_url in op ons endpoint. De modelnaam blijft uncensored.
Voorbeeldinitialisatie en completionaanroep:
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwchatbot.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Deze aanpak werkt voor eenvoudige tekstgeneratie of het bouwen van chains. Onthoud dat het model geen GPT-4 is; pas je prompt engineering daarop aan. Streaming wordt ondersteund via de parameter stream=True, gedetailleerd in de volgende sectie.
Node SDK
De Node.js OpenAI SDK volgt hetzelfde configuratiepatroon. Importeer de bibliotheek, stel de base URL en API-sleutel in en roep het endpoint voor voltooiingen aan. Dit is ideaal voor integraties aan de serverzijde of Node-gebaseerde chatapplicaties.
Voorbeeldinitialisatie:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwchatbot.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Het response-object bevat de gegenereerde inhoud in response.choices[0].message.content. Zorg dat je fouten op de juiste manier afhandelt, want netwerkproblemen of ongeldige sleutels veroorzaken uitzonderingen. Het ongecensureerde model reageert op standaard system prompts, zodat je de toon en het gedrag kunt bepalen via de message history.
Streaming antwoorden
Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert een stream van Servergezonden gebeurtenissen (SSE). Elke chunk bevat gedeeltelijke tekst. De laatste chunk bevat de statistieken voor tokengebruik. Streaming vermindert de waargenomen latentie voor gebruikers in NSFW-chatbotapplicaties.
Voorbeeld streamingverzoek:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Verwerk de stream door de inhoud van elke chunk aan je buffer toe te voegen. Houd de laatste chunk in de gaten voor gebruiksgegevens om kosten bij te houden. Tokenprijzen zijn $0,25 per miljoen inputtokens en $1,00 per miljoen outputtokens. Fouten en weigeringen worden niet in rekening gebracht.
Limieten, fouten & contextvenster
Elke API-sleutel staat 300 verzoeken per minuut en 8 gelijktijdige verzoeken toe. De request body moet kleiner zijn dan 8 MB. Als de sleutel ongeldig is, ontvang je een 401-fout. Een 402-fout geeft onvoldoende tegoed aan. Een 429-fout signaleert rate limiting. Contextvenster is 100.000 tokens totaal. Max output is 32.000 tokens indien gespecificeerd. Inhoud met minderjarigen wordt altijd geweigerd. Tegoed is prepaid via crypto en verloopt nooit. Gebruik deze limieten om retry-logica en wachtrijbeheer te ontwerpen voor je ongecensureerde AI API-integratie.