Documentatie Uncensored Chat Completies API
Deze documentatie begeleidt je bij de integratie van onze ongecensureerde LLM via het standaard OpenAI-compatible chat completies endpoint. Je kunt direct tekst genereren door je client te configureren met onze base URL en een pas gegenereerde API-sleutel.
Op deze pagina
Authenticatie & Instellen
Toegang vereist een geldige API-sleutel gekoppeld aan je account. Je genereert deze sleutel op de API-sleutel ophalen-pagina na het inloggen met e-mail en wachtwoord. De sleutel wordt direct na het aanmaken weergegeven. Om van een leverancier zoals OpenAI over te stappen, pas je de clientconfiguratie aan om naar onze basis-URL te verwijzen: https://api.unfilteredaimodels.com/v1 en voeg je je unieke API-sleutel toe. We ondersteunen de standaard Authorization-headerindeling.
Chat Completies Endpoint
De primaire interface is het POST /v1/chat/completions-endpoint. Het accepteert standaard berichtobjecten en retourneert tekstantwoorden. De model-ID die je moet opgeven is uncensored. Dit endpoint verwerkt ruwe tekstgeneratie zonder de gebruikelijke corporatieve veiligheidsmuren, waardoor volwassen, controversiële of creatieve inhoud binnen wettelijke grenzen mogelijk is. Je kunt je eerste verzoek verzenden met het volgende voorbeeld:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Dit verzoek demonstreert het verzenden van een eenvoudig systeem-prompt en een gebruikersvraag om een antwoord te genereren.
Python SDK Integratie
Gebruik het officiële openai Python-pakket. Initialiseer de client met onze basis-URL en je API-sleutel. Roep vervolgens chat.completions.create aan met de model-ID uncensored. Deze aanpak vereist geen code-aanpassingen als je al het OpenAI SDK gebruikt voor andere diensten. De volgende codefragmenten tonen hoe je de client initialiseert en een verzoek verzendt:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
De SDK verwerkt JSON-serialisatie en respons parsing automatisch.
Node.js SDK Integratie
Voor JavaScript-omgevingen gebruik je het openai Node.js-pakket. Configureer de basePath naar ons endpoint en geef je API-sleutel op. Roep de methode chat.completions.create aan met de model-ID uncensored. Dit zorgt voor compatibiliteit met bestaande Node.js-applicaties die OpenAI-standaardresponsen verwachten. Zo stel je de client in:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Deze opstelling zorgt ervoor dat je Node-applicatie kan communiceren met ons ongecensureerde model met behulp van bekende patronen.
Streaming Antwoorden
Stel de parameter stream in op true om server-sent events (SSE) te ontvangen. Hierdoor kun je tokens verwerken zodra ze worden gegenereerd, wat de waargenomen vertraging bij lange antwoorden vermindert. De API retourneert een stream van chunks, waarbij elke chunk gedeeltelijke responsdeltas bevat. Gebruik het volgende voorbeeld om streaming te implementeren:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Streaming is ideaal voor chatinterfaces waar gebruikers verwachten tekst in real-time te zien verschijnen.
Rate Limits & Kwota's
Je API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 Too Many Requests-fout. Je kunt je sleutel op elk moment opnieuw genereren via je dashboard, waardoor de oude sleutel ongeldig wordt en er een nieuwe wordt gegenereerd met een nieuwe rate limit-teller. Andere fouten zijn 401 voor ongeldige sleutels en 402 als je prepaid tegoed op is. Het contextvenster ondersteunt tot 100.000 tokens voor prompt en completion samen. Aanvraaglichamen zijn beperkt tot 8 MB.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| Model-ID | uncensored |
| JSON-modus | response_format: {"type": "json_object"} |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Reset mijn rate limit als ik mijn API-sleutel regeneer?
Ja. Het opnieuw genereren van je sleutel maakt de oude sleutel ongeldig en genereert een nieuwe met een nieuwe rate limit-teller. De limiet van 300 verzoeken per minuut geldt voor de specifieke sleutel die je gebruikt.
Welke inhoud is beperkt?
Het model weigert de meeste volwassen, fictieve of controversiële onderwerpen niet. Er geldt echter altijd een harde limiet: seksuele inhoud met minderjarigen wordt geblokkeerd.
Is het model gefinetuned of een standaard GPT?
Het is een open-weight model dat op onze eigen GPU-servers draait, afgestemd op ongecensureerde output. Het is geen GPT, Claude of een model van een andere leverancier.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele configuratie.