Bazowy URL i uwierzytelnianie
API działa pod adresem https://api.nsfwchatbot.cc/v1. Korzysta ze standardowej autoryzacji tokenem Bearer. Jedyny klucz API uzyskujesz na stronie Get API key, logując się przez Google lub e-mail. Klucz należy przesłać w nagłówku Authorization. Na koncie aktywny jest tylko jeden klucz; wygenerowanie nowego unieważnia poprzedni. Nie ma subskrypcji miesięcznych — kredyt jest przedpłacony i nigdy nie wygasa.
Upewnij się, że Twoja biblioteka klienta wskazuje na powyższy bazowy URL. Identyfikator modelu to zawsze uncensored. Jest to model o otwartych wagach dostrojony do minimalnej odmowy treści, różny od GPT lub Claude. Zwraca surowe odpowiedzi tekstowe bez ogólnych zabezpieczeń dla legalnej treści dla dorosłych.
Pierwsze zapytanie
Podstawowe zapytanie odzwierciedla endpoint chat-completions OpenAI. Określasz model, wiadomości i opcjonalne parametry. API zwraca odpowiedź tekstową. Jeśli pominiesz max_tokens, domyślny limit outputu to 2048 tokenów. Okno kontekstu obsługuje do 100 000 tokenów łącznie dla promptu i completion.
Poniższy przykład pokazuje standardowe zapytanie o uzupełnienie tekstu za pomocą curl.
curl https://api.nsfwchatbot.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Zwraca to obiekt JSON zawierający wygenerowany tekst. Błędy zwracają standardowe kody statusu HTTP z obiektem błędu w ciele odpowiedzi.
SDK Python
Użyj oficjalnej biblioteki Python OpenAI, konfigurując ją do wskazywania na nasz bazowy URL. Pozwala to wykorzystać istniejący kod klienta przy minimalnych zmianach. Przekaż swój klucz API jako api_key i ustaw base_url na nasz endpoint. Nazwa modelu pozostaje uncensored.
Przykład inicjalizacji i wywołania uzupełnienia:
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwchatbot.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)To podejście działa do prostego generowania tekstu lub budowania łańcuchów. Pamiętaj, że model nie jest GPT-4; dostosuj accordingly inżynierię promptów. Strumieniowanie jest obsługiwane przez parametr stream=True, szczegółowo opisany w kolejnej sekcji.
SDK Node.js
SDK OpenAI dla Node.js stosuje ten sam wzorzec konfiguracji. Zaimportuj bibliotekę, ustaw bazowy URL i klucz API oraz wywołaj endpoint uzupełnień. Jest to idealne dla integracji po stronie serwera lub aplikacji czatu opartych na Node.
Przykład inicjalizacji:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwchatbot.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Obiekt odpowiedzi zawiera wygenerowaną treść w response.choices[0].message.content. Upewnij się, że obsługujesz błędy odpowiednio, ponieważ problemy z siecią lub nieprawidłowe klucze rzucą wyjątki. Model bez cenzury reaguje na standardowe prompty systemowe, pozwalając zdefiniować ton i zachowanie poprzez historię wiadomości.
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true w zapytaniu. API zwraca strumień zdarzeń wysłanych przez serwer (SSE). Każdy fragment zawiera częściowy tekst. Ostatni fragment zawiera statystyki użycia tokenów. Strumieniowanie zmniejsza postrzeganą opóźnienie dla użytkowników w aplikacjach czatu NSFW.
Przykład zapytania strumieniowego:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Przetwarzaj strumień, dołączając zawartość każdego fragmentu do swojego bufora. Monitoruj ostatni fragment pod kątem danych o użyciu, aby śledzić koszty. Cennik tokenów to $0,25 za milion tokenów wejściowych i $1,00 za milion tokenów wyjściowych. Błędy i odmowy nie generują kosztów.
Limity, błędy i okno kontekstu
Każdy klucz API pozwala na 300 zapytań na minutę i 8 zapytań równoległych. Ciało zapytania musi być mniejsze niż 8 MB. Jeśli klucz jest nieprawidłowy, otrzymasz błąd 401. Błąd 402 oznacza niewystarczający kredyt. Błąd 429 sygnalizuje limit zapytań. Okno kontekstu wynosi 100 000 tokenów łącznie. Maksymalny output to 32 000 tokenów, jeśli zostanie określony. Treści dotyczące małoletnich są zawsze odrzucane. Kredyt jest przedpłacony kryptowalutą i nigdy nie wygasa. Użyj tych limitów do zaprojektowania logiki ponownych prób i zarządzania kolejką dla integracji API AI bez cenzury.