DE ▾
API-Schlüssel erhalten
  1. Nsfwchat
  2. NSFW-Chat: Schnellstart: Integriere das unzensierte LLM

NSFW-Chat: Schnellstart: Integriere das unzensierte LLM

Integriere unsere unzensierte LLM-API über Standard-OpenAI-kompatible Endpunkte. Dieser Schnellstart behandelt Authentifizierung, Anfrageformate und Streaming für die Textgenerierung mit hohem Volumen.

Basis-URL & Authentifizierung

Verwende die dedizierte Basis-URL für alle Anfragen. Die Authentifizierung basiert auf einem einzelnen API-Schlüssel, den du bei der Anmeldung erstellst. Füge den Schlüssel im Authorization-Header als Bearer-Token ein. Dein Schlüssel wird sofort nach der Erstellung angezeigt. Jedes Konto hat einen aktiven Schlüssel; das Generieren eines neuen ersetzt den alten.

Die Basis-URL lautet: https://api.nsfwchat.cc/v1. Es sind keine zusätzlichen Routing- oder Proxy-Ebenen erforderlich. Diese Einrichtung funktioniert mit jedem OpenAI-kompatiblen Client durch Anpassung der Basis-URL und des API-Schlüssels.

Chat-Vervollständigungen

Sende Text-Prompts an den POST /v1/chat/completions-Endpunkt. Die Modell-ID ist uncensored. Dieser Endpunkt akzeptiert Standard-Chat-Nachrichten und gibt generierten Text zurück. Er unterstützt keine Embeddings, Bilder oder Audio. Das Modell ist auf unzensierte Antworten zu rechtmäßigen Erwachseneninhalten optimiert.

Stelle sicher, dass deine Payload die Modell-ID und den Nachrichtenverlauf enthält. Die API verarbeitet Texteingaben und gibt Textausgaben direkt zurück.

curl https://api.nsfwchat.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python SDK

Verwende das offizielle OpenAI Python SDK für die Integration. Setze die base_url auf unseren API-Endpunkt und gib deinen API-Schlüssel an. Das SDK übernimmt die Serialisierung und Fehleranalyse automatisch. Konfiguriere Parameter wie temperature und top_p, um die Zufälligkeit der Ausgabe zu steuern.

Initialisiere den Client mit deinem Schlüssel und der Basis-URL. Rufe chat.completions.create() mit der Modell-ID und den Nachrichten auf. Dieser Ansatz reduziert den Boilerplate-Code für einfache Textgenerierungsaufgaben.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwchat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node SDK

Das Node.js OpenAI SDK funktioniert identisch zur Python-Version. Konfiguriere den Client mit der benutzerdefinierten Basis-URL und deinem API-Schlüssel. Verwende die Methode chat.completions.create, um Anfragen zu senden.

Diese Methode ist ideal für serverseitige Integrationen. Das SDK verwaltet Connection-Pooling und Wiederholungen. Stelle das Modell auf uncensored, um unzensierte Antworten zu gewährleisten. Übergebe Nachrichten als Array von Rolle- und Inhaltsobjekten.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwchat.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming-Antworten

Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält teilweise Text. Token-Nutzungsdetails erscheinen im letzten Chunk.

Streaming reduziert die wahrgenommene Latenz für lange Ausgaben. Verarbeite jeden Chunk sequenziell, um die vollständige Antwort wiederherzustellen. Diese Methode ist entscheidend für Echtzeit-UI-Aktualisierungen. Behandle Fehler innerhalb der Stream-Events, um die Verbindungsstabilität aufrechtzuerhalten.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ratenlimits & Fehler

Respektiere die Ratenlimits, um Dienstunterbrechungen zu vermeiden. Die API erlaubt 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Ein 401-Status zeigt einen ungültigen oder fehlenden API-Schlüssel an. Ein 429-Status zeigt an, dass du das Ratenlimit überschritten hast.

Das Kontextfenster umfasst 100.000 Token für Prompt und Vervollständigung zusammen. Wenn du dieses Limit überschreitest, wird die Anfrage abgelehnt. Es gibt keine Kürzung; stelle sicher, dass deine Eingabe in das Fenster passt. Ein 402-Status zeigt einen unzureichenden Prepaid-Guthaben an. Fehler und Ablehnungen verbrauchen kein Guthaben.

Funktionen und Limits

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
Modell-IDuncensored
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.nsfwchat.cc/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
JSON-Modusresponse_format: {"type": "json_object"}
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Ratenlimit300 Anfragen pro Minute und Schlüssel
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Bonus+5 % ab $50, +10 % ab $100
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
AnmeldungGoogle oder E-Mail und Passwort
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Unterstützt die API Function Calling?

Ja, die API unterstützt Function Calling über die Parameter <code>tools</code> und <code>tool_choice</code>. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturiertes JSON für die Tool-Nutzung zurück. Diese Funktion funktioniert mit Standard-OpenAI-kompatiblen Clients.

Wie groß ist das Kontextfenster?

Das Kontextfenster umfasst 100.000 Token, sowohl für den Prompt als auch für die Antwort. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token bzw. 2.048, wenn <code>max_tokens</code> nicht festgelegt ist. Anfragen, die dieses Fenster überschreiten, werden abgelehnt.

Wie werden Fehler behandelt?

Fehlerantworten enthalten einen Statuscode und eine Nachricht. Ein <code>401</code>-Code bedeutet, dass der API-Schlüssel ungültig ist. Ein <code>429</code>-Code bedeutet, dass du das Ratenlimit erreicht hast. Ein <code>402</code>-Code zeigt einen unzureichenden Prepaid-Guthaben an. Fehler verbrauchen nicht dein Token-Guthaben.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.