- Nsfwchat
- NSFW-Chat: Schnellstart: Integriere das unzensierte LLM
NSFW-Chat: Schnellstart: Integriere das unzensierte LLM
Integriere unsere unzensierte LLM-API über Standard-OpenAI-kompatible Endpunkte. Dieser Schnellstart behandelt Authentifizierung, Anfrageformate und Streaming für die Textgenerierung mit hohem Volumen.
Basis-URL & Authentifizierung
Verwende die dedizierte Basis-URL für alle Anfragen. Die Authentifizierung basiert auf einem einzelnen API-Schlüssel, den du bei der Anmeldung erstellst. Füge den Schlüssel im Authorization-Header als Bearer-Token ein. Dein Schlüssel wird sofort nach der Erstellung angezeigt. Jedes Konto hat einen aktiven Schlüssel; das Generieren eines neuen ersetzt den alten.
Die Basis-URL lautet: https://api.nsfwchat.cc/v1. Es sind keine zusätzlichen Routing- oder Proxy-Ebenen erforderlich. Diese Einrichtung funktioniert mit jedem OpenAI-kompatiblen Client durch Anpassung der Basis-URL und des API-Schlüssels.
Chat-Vervollständigungen
Sende Text-Prompts an den POST /v1/chat/completions-Endpunkt. Die Modell-ID ist uncensored. Dieser Endpunkt akzeptiert Standard-Chat-Nachrichten und gibt generierten Text zurück. Er unterstützt keine Embeddings, Bilder oder Audio. Das Modell ist auf unzensierte Antworten zu rechtmäßigen Erwachseneninhalten optimiert.
Stelle sicher, dass deine Payload die Modell-ID und den Nachrichtenverlauf enthält. Die API verarbeitet Texteingaben und gibt Textausgaben direkt zurück.
curl https://api.nsfwchat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Python SDK
Verwende das offizielle OpenAI Python SDK für die Integration. Setze die base_url auf unseren API-Endpunkt und gib deinen API-Schlüssel an. Das SDK übernimmt die Serialisierung und Fehleranalyse automatisch. Konfiguriere Parameter wie temperature und top_p, um die Zufälligkeit der Ausgabe zu steuern.
Initialisiere den Client mit deinem Schlüssel und der Basis-URL. Rufe chat.completions.create() mit der Modell-ID und den Nachrichten auf. Dieser Ansatz reduziert den Boilerplate-Code für einfache Textgenerierungsaufgaben.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwchat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Node SDK
Das Node.js OpenAI SDK funktioniert identisch zur Python-Version. Konfiguriere den Client mit der benutzerdefinierten Basis-URL und deinem API-Schlüssel. Verwende die Methode chat.completions.create, um Anfragen zu senden.
Diese Methode ist ideal für serverseitige Integrationen. Das SDK verwaltet Connection-Pooling und Wiederholungen. Stelle das Modell auf uncensored, um unzensierte Antworten zu gewährleisten. Übergebe Nachrichten als Array von Rolle- und Inhaltsobjekten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwchat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true in deiner Anfrage setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält teilweise Text. Token-Nutzungsdetails erscheinen im letzten Chunk.
Streaming reduziert die wahrgenommene Latenz für lange Ausgaben. Verarbeite jeden Chunk sequenziell, um die vollständige Antwort wiederherzustellen. Diese Methode ist entscheidend für Echtzeit-UI-Aktualisierungen. Behandle Fehler innerhalb der Stream-Events, um die Verbindungsstabilität aufrechtzuerhalten.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Ratenlimits & Fehler
Respektiere die Ratenlimits, um Dienstunterbrechungen zu vermeiden. Die API erlaubt 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel. Die maximale Größe des Anfragekörpers beträgt 8 MB. Ein 401-Status zeigt einen ungültigen oder fehlenden API-Schlüssel an. Ein 429-Status zeigt an, dass du das Ratenlimit überschritten hast.
Das Kontextfenster umfasst 100.000 Token für Prompt und Vervollständigung zusammen. Wenn du dieses Limit überschreitest, wird die Anfrage abgelehnt. Es gibt keine Kürzung; stelle sicher, dass deine Eingabe in das Fenster passt. Ein 402-Status zeigt einen unzureichenden Prepaid-Guthaben an. Fehler und Ablehnungen verbrauchen kein Guthaben.
Funktionen und Limits
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfen Sie sie, bevor Sie Guthaben kaufen.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.nsfwchat.cc/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Anmeldung | Google oder E-Mail und Passwort |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Unterstützt die API Function Calling?
Ja, die API unterstützt Function Calling über die Parameter <code>tools</code> und <code>tool_choice</code>. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturiertes JSON für die Tool-Nutzung zurück. Diese Funktion funktioniert mit Standard-OpenAI-kompatiblen Clients.
Wie groß ist das Kontextfenster?
Das Kontextfenster umfasst 100.000 Token, sowohl für den Prompt als auch für die Antwort. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token bzw. 2.048, wenn <code>max_tokens</code> nicht festgelegt ist. Anfragen, die dieses Fenster überschreiten, werden abgelehnt.
Wie werden Fehler behandelt?
Fehlerantworten enthalten einen Statuscode und eine Nachricht. Ein <code>401</code>-Code bedeutet, dass der API-Schlüssel ungültig ist. Ein <code>429</code>-Code bedeutet, dass du das Ratenlimit erreicht hast. Ein <code>402</code>-Code zeigt einen unzureichenden Prepaid-Guthaben an. Fehler verbrauchen nicht dein Token-Guthaben.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.