FR ▾
Obtenir une clé API

Documentation de l'API de complétion de chat sans censure

Cette documentation vous guide pour intégrer notre LLM sans censure via l'endpoint standard de complétion de chat compatible OpenAI. Vous pouvez commencer à générer du texte immédiatement en configurant votre client avec notre URL de base et une clé API fraîchement générée.

Sur cette page
  1. Authentification et configuration
  2. Endpoint de complétion de chat
  3. Intégration du SDK Python
  4. Intégration du SDK Node.js
  5. Réponses en streaming
  6. Limites de débit et quotas

Authentification et configuration

L'accès nécessite une clé API valide associée à votre compte. Vous générez cette clé sur la page Obtenir la clé API après vous être inscrit avec un e-mail et un mot de passe. La clé est affichée immédiatement après sa création. Pour passer d'un fournisseur comme OpenAI, mettez à jour la configuration de votre client pour pointer vers notre URL de base : https://api.unfilteredaimodels.com/v1 et fournissez votre clé API unique. Nous prenons en charge le format standard de l'en-tête Authorization.

Endpoint de complétion de chat

L'interface principale est l'endpoint POST /v1/chat/completions. Il accepte des objets de messages standard et renvoie des réponses textuelles. L'ID de modèle à spécifier est uncensored. Cet endpoint gère la génération de texte brut sans les garde-fous corporatifs habituels, permettant du contenu pour adultes, controversé ou créatif dans les limites légales. Vous pouvez envoyer votre première requête en utilisant l'exemple suivant :

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Cette requête démontre l'envoi d'un prompt système simple et d'une requête utilisateur pour générer une réponse.

Intégration du SDK Python

Utilisez le package Python officiel openai. Initialisez le client avec notre URL de base et votre clé API. Appelez ensuite chat.completions.create avec l'ID de modèle uncensored. Cette approche ne nécessite aucun changement de code si vous utilisez déjà le SDK OpenAI pour d'autres services. L'extrait de code suivant montre comment initialiser le client et envoyer une requête :

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Le SDK gère automatiquement la sérialisation JSON et l'analyse des réponses.

Intégration du SDK Node.js

Pour les environnements JavaScript, utilisez le package Node.js openai. Configurez le basePath vers notre endpoint et fournissez votre clé API. Appelez la méthode chat.completions.create avec l'ID de modèle uncensored. Cela garantit la compatibilité avec les applications Node.js existantes qui s'attendent à des réponses conformes au standard OpenAI. Voici comment configurer le client :

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Cette configuration permet à votre application Node de communiquer avec notre modèle sans censure en utilisant des schémas familiers.

Réponses en streaming

Définissez le paramètre stream sur true pour recevoir des événements envoyés par le serveur (SSE). Cela vous permet de traiter les tokens au fur et à mesure de leur génération, réduisant la latence perçue pour les réponses longues. L'API renvoie un flux de chunks, chacun contenant des deltas partiels de la réponse. Utilisez l'exemple suivant pour implémenter le streaming :

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Le streaming est idéal pour les interfaces de chat où les utilisateurs s'attendent à voir le texte apparaître en temps réel.

Limites de débit et quotas

Votre clé API est limitée à 300 requêtes par minute. Si vous dépassez ce seuil, vous recevez une erreur 429 Too Many Requests. Vous pouvez régénérer votre clé à tout moment depuis votre tableau de bord, ce qui révoque l'ancienne clé et en fournit une nouvelle avec un compteur de limite de débit. Les autres erreurs incluent 401 pour les clés invalides et 402 si votre crédit prépayé est épuisé. La fenêtre de contexte prend en charge jusqu'à 100 000 tokens pour le prompt et la complétion combinés. Les corps de requête sont limités à 8 Mo.

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.unfilteredaimodels.com/v1
ID du modèleuncensored
Mode JSONresponse_format: {"type": "json_object"}
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Fenêtre de contexte100 000 tokens (entrée + sortie)
Limite de débit300 requêtes par minute et par clé
Concurrence8 requêtes simultanées par clé
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Validitéle crédit payé n'expire jamais, sans abonnement
Bonus+5 % dès 50 $, +10 % dès 100 $
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

La régénération de ma clé API réinitialise-t-elle ma limite de débit ?

Oui. La régénération de votre clé révoque l'ancienne et en émet une nouvelle avec un compteur de limite de débit frais. La limite de 300 requêtes par minute s'applique à la clé spécifique utilisée.

Quel contenu est restreint ?

Le modèle ne refuse pas la plupart des sujets pour adultes, fictifs ou controversés. Cependant, une limite absolue s'applique toujours : le contenu sexuel impliquant des mineurs est bloqué.

Le modèle est-il finement ajusté ou s'agit-il d'un GPT standard ?

Il s'agit d'un modèle à poids ouverts exécuté sur nos propres serveurs GPU, ajusté pour une sortie sans censure. Ce n'est ni un GPT, ni un Claude, ni le modèle d'un autre fournisseur.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.