IT ▾
Ottieni la chiave API

Documentazione API Completions Chat senza censura

Questa documentazione ti guida nell'integrazione del nostro LLM senza censura tramite l'endpoint standard di chat completions compatibile con OpenAI. Puoi iniziare a generare testo immediatamente configurando il tuo client con il nostro URL base e una chiave API appena generata.

In questa pagina
  1. Autenticazione e configurazione
  2. Endpoint Chat Completions
  3. Integrazione SDK Python
  4. Integrazione SDK Node.js
  5. Risposte in streaming
  6. Limiti di richiesta e quote

Autenticazione e configurazione

L'accesso richiede una chiave API valida associata al tuo account. Genera questa chiave nella pagina Ottieni chiave API dopo esserti registrato con email e password. La chiave viene visualizzata immediatamente dopo la creazione. Per passare da un fornitore come OpenAI, aggiorna la configurazione del tuo client per puntare al nostro URL di base: https://api.unfilteredaimodels.com/v1 e fornisci la tua chiave API univoca. Supportiamo il formato standard dell'intestazione Authorization.

Endpoint Chat Completions

L'interfaccia principale è l'endpoint POST /v1/chat/completions. Accetta oggetti di messaggio standard e restituisce risposte testuali. L'ID del modello da specificare è uncensored. Questo endpoint gestisce la generazione di testo grezzo senza i tipici limiti aziendali, consentendo contenuti per adulti, controversi o creativi entro i limiti legali. Puoi inviare la tua prima richiesta utilizzando il seguente esempio:

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Questa richiesta dimostra l'invio di un semplice prompt di sistema e di una query utente per generare una risposta.

Integrazione SDK Python

Utilizza il pacchetto Python ufficiale openai. Inizializza il client con il nostro URL di base e la tua chiave API. Quindi chiama chat.completions.create con l'ID del modello uncensored. Questo approccio non richiede modifiche al codice se stai già utilizzando l'SDK OpenAI per altri servizi. Il seguente snippet mostra come inizializzare il client e inviare una richiesta:

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

L'SDK gestisce automaticamente la serializzazione JSON e l'analisi della risposta.

Integrazione SDK Node.js

Per gli ambienti JavaScript, utilizza il pacchetto Node openai. Configura il basePath sul nostro endpoint e fornisci la tua chiave API. Chiama il metodo chat.completions.create con l'ID del modello uncensored. Questo assicura la compatibilità con le applicazioni Node.js esistenti che si aspettano risposte standard OpenAI. Ecco come configurare il client:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Questa configurazione assicura che la tua applicazione Node possa comunicare con il nostro modello senza censura utilizzando pattern familiari.

Risposte in streaming

Imposta il parametro stream su true per ricevere eventi inviati dal server (SSE). Questo ti permette di elaborare i token man mano che vengono generati, riducendo la latenza percepita per le risposte lunghe. L'API restituisce uno stream di chunk, ciascuno contenente delta parziali della risposta. Usa l'esempio seguente per implementare lo streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lo streaming è ideale per le interfacce chat dove gli utenti si aspettano di vedere il testo apparire in tempo reale.

Limiti di richiesta e quote

La tua chiave API è limitata a 300 richieste al minuto. Superato il limite, ricevi l'errore 429 Too Many Requests. Puoi rigenerare la chiave dal dashboard, revocando quella vecchia e assegnandone una nuova con contatore limiti. Altri errori: 401 per chiavi non valide, 402 se il credito è esaurito. Il contesto supporta fino a 100.000 token (prompt + completamento). Il corpo della richiesta è limitato a 8 MB.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
AutenticazioneAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.unfilteredaimodels.com/v1
ID modellouncensored
Modalità JSONresponse_format: {"type": "json_object"}
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Finestra di contesto100.000 token (input + output)
Limite di frequenza300 richieste al minuto per chiave
Concorrenza8 richieste contemporanee per chiave
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Scadenzail credito pagato non scade, nessun abbonamento
Bonus+5% da $50, +10% da $100
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Rigenerare la chiave API resetta il limite di richieste?

Sì. Rigenerando la chiave revochi quella vecchia e ne ottieni una nuova con un contatore del limite di richieste fresco. Il limite di 300 richieste al minuto si applica alla chiave specifica in uso.

Qual è il contenuto limitato?

Il modello non rifiuta la maggior parte dei temi per adulti, di fantasia o controversi. Tuttavia, vale sempre un limite rigido: i contenuti sessuali che coinvolgono minori sono bloccati.

Il modello è fine-tuned o un GPT standard?

È un modello a pesi aperti eseguito sui nostri server GPU, ottimizzato per output senza censura. Non è GPT, Claude o il modello di nessun altro fornitore.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL base. È tutta qui la configurazione.