- Nsfwchat
- Chat NSFW: Guida rapida: Integra LLM senza censura
Chat NSFW: Guida rapida: Integra LLM senza censura
Integra la nostra API LLM senza censura utilizzando endpoint standard compatibili con OpenAI. Questa guida rapida copre autenticazione, formati di richiesta e streaming per la generazione di testo ad alto volume.
URL base e autenticazione
Usa l'URL base dedicato per tutte le richieste. L'autenticazione si basa su una singola chiave API generata durante la registrazione. Inserisci la chiave nell'intestazione Authorization come token Bearer. La tua chiave viene visualizzata immediatamente dopo la creazione. Ogni account ha una chiave attiva; generarne una nuova sostituisce quella vecchia.
L'URL base è: https://api.nsfwchat.cc/v1. Non sono necessari layer di instradamento o proxy aggiuntivi. Questa configurazione funziona con qualsiasi client compatibile con OpenAI modificando l'URL base e la chiave API.
Completamenti chat
Invia prompt di testo all'endpoint POST /v1/chat/completions. L'ID del modello è uncensored. Questo endpoint accetta messaggi di chat standard e restituisce testo generato. Non supporta embedding, immagini o audio. Il modello è ottimizzato per risposte senza censura a contenuti per adulti leciti.
Assicurati che il payload includa l'ID del modello e la cronologia dei messaggi. L'API elabora l'input testuale e restituisce direttamente l'output testuale.
curl https://api.nsfwchat.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
SDK Python
Utilizza l'SDK Python ufficiale di OpenAI per l'integrazione. Imposta base_url sul nostro endpoint API e fornisci la tua chiave API. L'SDK gestisce automaticamente la serializzazione e l'analisi degli errori. Configura parametri come temperature e top_p per controllare la casualità dell'output.
Inizializza il client con la tua chiave e URL base. Chiama chat.completions.create() con l'ID del modello e i messaggi. Questo approccio riduce il codice boilerplate per semplici attività di generazione di testo.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwchat.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK Node.js
L'SDK OpenAI per Node.js funziona identicamente alla versione Python. Configura il client con l'URL base personalizzato e la tua chiave API. Usa il metodo chat.completions.create per inviare richieste.
Questo metodo è ideale per le integrazioni lato server. L'SDK gestisce il pooling delle connessioni e i tentativi di ripetizione. Imposta il modello su uncensored per garantire risposte senza censura. Passa i messaggi come matrice di oggetti ruolo e contenuto.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwchat.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Risposte in streaming
Abilita lo streaming impostando stream: true nella tua richiesta. L'API restituisce Server-Sent Events (SSE). Ogni chunk contiene testo parziale. I dettagli sull'utilizzo dei token appaiono nell'ultimo chunk.
Lo streaming riduce la latenza percepita per output lunghi. Gestisci ogni chunk in sequenza per ricostruire la risposta completa. Questo metodo è essenziale per gli aggiornamenti dell'interfaccia utente in tempo reale. Gestisci gli errori all'interno degli eventi stream per mantenere la stabilità della connessione.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Limiti di velocità ed errori
Rispetta i limiti di velocità per evitare interruzioni del servizio. L'API consente 300 richieste al minuto e 8 richieste parallele per chiave. La dimensione massima del corpo della richiesta è di 8 MB. Uno stato 401 indica una chiave API non valida o mancante. Uno stato 429 indica che hai superato il limite di velocità.
La finestra di contesto è di 100.000 token per prompt e completamento combinati. Se superi questo limite, la richiesta verrà rifiutata. Non c'è troncamento; assicurati che il tuo input rientri nella finestra. Un codice di stato 402 indica un saldo prepagato insufficiente. Gli errori e i rifiuti non consumano credito.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.nsfwchat.cc/v1 |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Bonus | +5% da $50, +10% da $100 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
L'API supporta la chiamata di funzioni?
Sì, l'API supporta la chiamata di funzioni tramite i parametri <code>tools</code> e <code>tool_choice</code>. Puoi definire gli strumenti nella richiesta e il modello restituirà JSON strutturato per l'uso degli strumenti. Questa funzione è compatibile con i client standard compatibili con OpenAI.
Qual è la dimensione della finestra di contesto?
La finestra di contesto è di 100.000 token, che combinano sia il prompt che il completamento. L'output massimo per richiesta è di 32.000 token, o 2.048 se <code>max_tokens</code> non è impostato. Le richieste che superano questa finestra vengono rifiutate.
Come vengono gestiti gli errori?
Le risposte di errore includono un codice di stato e un messaggio. Un codice <code>401</code> indica che la chiave API non è valida. Un codice <code>429</code> indica che hai raggiunto il limite di richieste. Un codice <code>402</code> indica un saldo prepagato insufficiente. Gli errori non consumano il tuo credito token.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.