Documentation de l'API de complétion de chat sans censure
Cette documentation vous guide pour intégrer notre LLM sans censure via l'endpoint standard de complétion de chat compatible OpenAI. Vous pouvez commencer à générer du texte immédiatement en configurant votre client avec notre URL de base et une clé API fraîchement générée.
Sur cette page
Authentification et configuration
L'accès nécessite une clé API valide associée à votre compte. Vous générez cette clé sur la page Obtenir la clé API après vous être inscrit avec un e-mail et un mot de passe. La clé est affichée immédiatement après sa création. Pour passer d'un fournisseur comme OpenAI, mettez à jour la configuration de votre client pour pointer vers notre URL de base : https://api.unfilteredaimodels.com/v1 et fournissez votre clé API unique. Nous prenons en charge le format standard de l'en-tête Authorization.
Endpoint de complétion de chat
L'interface principale est l'endpoint POST /v1/chat/completions. Il accepte des objets de messages standard et renvoie des réponses textuelles. L'ID de modèle à spécifier est uncensored. Cet endpoint gère la génération de texte brut sans les garde-fous corporatifs habituels, permettant du contenu pour adultes, controversé ou créatif dans les limites légales. Vous pouvez envoyer votre première requête en utilisant l'exemple suivant :
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Cette requête démontre l'envoi d'un prompt système simple et d'une requête utilisateur pour générer une réponse.
Intégration du SDK Python
Utilisez le package Python officiel openai. Initialisez le client avec notre URL de base et votre clé API. Appelez ensuite chat.completions.create avec l'ID de modèle uncensored. Cette approche ne nécessite aucun changement de code si vous utilisez déjà le SDK OpenAI pour d'autres services. L'extrait de code suivant montre comment initialiser le client et envoyer une requête :
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Le SDK gère automatiquement la sérialisation JSON et l'analyse des réponses.
Intégration du SDK Node.js
Pour les environnements JavaScript, utilisez le package Node.js openai. Configurez le basePath vers notre endpoint et fournissez votre clé API. Appelez la méthode chat.completions.create avec l'ID de modèle uncensored. Cela garantit la compatibilité avec les applications Node.js existantes qui s'attendent à des réponses conformes au standard OpenAI. Voici comment configurer le client :
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Cette configuration permet à votre application Node de communiquer avec notre modèle sans censure en utilisant des schémas familiers.
Réponses en streaming
Définissez le paramètre stream sur true pour recevoir des événements envoyés par le serveur (SSE). Cela vous permet de traiter les tokens au fur et à mesure de leur génération, réduisant la latence perçue pour les réponses longues. L'API renvoie un flux de chunks, chacun contenant des deltas partiels de la réponse. Utilisez l'exemple suivant pour implémenter le streaming :
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Le streaming est idéal pour les interfaces de chat où les utilisateurs s'attendent à voir le texte apparaître en temps réel.
Limites de débit et quotas
Votre clé API est limitée à 300 requêtes par minute. Si vous dépassez ce seuil, vous recevez une erreur 429 Too Many Requests. Vous pouvez régénérer votre clé à tout moment depuis votre tableau de bord, ce qui révoque l'ancienne clé et en fournit une nouvelle avec un compteur de limite de débit. Les autres erreurs incluent 401 pour les clés invalides et 402 si votre crédit prépayé est épuisé. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Les corps de requête sont limités à 8 Mo.
Caractéristiques techniques
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| ID du modèle | uncensored |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
La régénération de ma clé API réinitialise-t-elle ma limite de débit ?
Oui. La régénération de votre clé révoque l'ancienne et en émet une nouvelle avec un compteur de limite de débit frais. La limite de 300 requêtes par minute s'applique à la clé spécifique utilisée.
Quel contenu est restreint ?
Le modèle ne refuse pas la plupart des sujets pour adultes, fictifs ou controversés. Cependant, une limite absolue s'applique toujours : le contenu sexuel impliquant des mineurs est bloqué.
Le modèle est-il finement ajusté ou s'agit-il d'un GPT standard ?
Il s'agit d'un modèle à poids ouverts exécuté sur nos propres serveurs GPU, ajusté pour une sortie sans censure. Ce n'est ni un GPT, ni un Claude, ni le modèle d'un autre fournisseur.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.