FR ▾
Obtenir une clé API
  1. Nsfwchat
  2. NSFW Chat : Guide de démarrage : Intégrez le LLM sans censure

NSFW Chat : Guide de démarrage : Intégrez le LLM sans censure

Intégrez notre API LLM sans censure en utilisant des endpoints compatibles OpenAI standards. Ce guide de démarrage couvre l'authentification, les formats de requête et le streaming pour la génération de texte à haut volume.

URL de base & Authentification

Utilisez l'URL de base dédiée pour toutes les requêtes. L'authentification repose sur une seule clé API générée lors de l'inscription. Incluez la clé dans l'en-tête Authorization en tant que jeton Bearer. Votre clé est affichée immédiatement après sa création. Chaque compte détient une clé active ; en générer une nouvelle remplace l'ancienne.

L'URL de base est : https://api.nsfwchat.cc/v1. Aucune couche de routage ou de proxy supplémentaire n'est requise. Cette configuration fonctionne avec n'importe quel client compatible OpenAI en ajustant l'URL de base et la clé API.

Chat Completions

Envoyez des prompts texte à l'endpoint POST /v1/chat/completions. L'ID du modèle est uncensored. Cet endpoint accepte les messages de chat standards et renvoie du texte généré. Il ne prend pas en charge les embeddings, les images ou l'audio. Le modèle est optimisé pour des réponses sans censure au contenu adulte légal.

Assurez-vous que votre charge utile inclut l'ID du modèle et l'historique des messages. L'API traite l'entrée textuelle et renvoie directement la sortie textuelle.

curl https://api.nsfwchat.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

SDK Python

Utilisez le SDK Python officiel d'OpenAI pour l'intégration. Définissez base_url sur notre endpoint et fournissez votre clé API. Le SDK gère automatiquement la sérialisation et le parsing. Configurez des paramètres comme temperature et top_p pour contrôler l'aléatoire de la sortie.

Initialisez le client avec votre clé et votre URL de base. Appelez chat.completions.create() avec l'ID du modèle et les messages. Cette approche réduit le code boilerplate pour les tâches simples de génération de texte.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwchat.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK Node

Le SDK OpenAI Node.js fonctionne de manière identique à la version Python. Configurez le client avec l'URL de base personnalisée et votre clé API. Utilisez la méthode chat.completions.create pour envoyer des requêtes.

Cette méthode est idéale pour les intégrations côté serveur. Le SDK gère le pool de connexions et les nouvelles tentatives. Définissez le modèle sur uncensored pour garantir des réponses sans censure. Transmettez les messages sous forme de tableau d'objets contenant le rôle et le contenu.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwchat.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. L'API renvoie des événements envoyés par le serveur (SSE). Chaque chunk contient du texte partiel. Les détails d'utilisation des tokens apparaissent dans le dernier chunk.

Le streaming réduit la latence perçue pour les sorties longues. Traitez chaque chunk séquentiellement pour reconstituer la réponse complète. Cette méthode est essentielle pour les mises à jour d'interface utilisateur en temps réel. Gérez les erreurs dans les événements de streaming pour maintenir la stabilité de la connexion.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Limites de débit & Erreurs

Respectez les limites de débit pour éviter les interruptions de service. L'API autorise 300 requêtes par minute et 8 requêtes simultanées par clé. La taille maximale du corps de la requête est de 8 Mo. Un statut 401 indique une clé API invalide ou manquante. Un statut 429 indique que vous avez dépassé la limite de débit.

La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. Si vous dépassez cette limite, la requête sera rejetée. Il n'y a pas de troncature ; assurez-vous que votre entrée tient dans la fenêtre. Un statut 402 indique un solde prépayé insuffisant. Les erreurs et les refus ne consomment pas de crédit.

Fonctions et limites

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
ID du modèleuncensored
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.nsfwchat.cc/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
Mode JSONresponse_format: {"type": "json_object"}
Fenêtre de contexte100 000 tokens (entrée + sortie)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
Validitéle crédit payé n'expire jamais, sans abonnement
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Bonus+5 % dès 50 $, +10 % dès 100 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Clésune clé active par compte ; une nouvelle remplace l'ancienne
ConnexionGoogle ou e-mail et mot de passe
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

L'API prend-elle en charge l'appel de fonctions ?

Oui, l'API prend en charge l'appel de fonctions via les paramètres <code>tools</code> et <code>tool_choice</code>. Vous pouvez définir des outils dans votre requête et le modèle renverra du JSON structuré pour l'utilisation des outils. Cette fonctionnalité fonctionne avec les clients compatibles OpenAI standards.

Quelle est la taille de la fenêtre de contexte ?

La fenêtre de contexte est de 100 000 tokens, combinant à la fois le prompt et la complétion. La sortie maximale par requête est de 32 000 tokens, ou 2 048 si <code>max_tokens</code> n'est pas défini. Les requêtes dépassant cette fenêtre sont rejetées.

Comment les erreurs sont-elles gérées ?

Les réponses d'erreur incluent un code d'état et un message. Un code <code>401</code> signifie que la clé API est invalide. Un code <code>429</code> signifie que vous avez atteint la limite de débit. Un code <code>402</code> indique un solde prépayé insuffisant. Les erreurs ne consomment pas votre crédit de tokens.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.