NL ▾
API-sleutel aanvragen

Documentatie Uncensored Chat Completies API

Deze documentatie begeleidt je bij de integratie van onze ongecensureerde LLM via het standaard OpenAI-compatible chat completies endpoint. Je kunt direct tekst genereren door je client te configureren met onze base URL en een pas gegenereerde API-sleutel.

Op deze pagina
  1. Authenticatie & Instellen
  2. Chat Completies Endpoint
  3. Python SDK Integratie
  4. Node.js SDK Integratie
  5. Streaming Antwoorden
  6. Rate Limits & Kwota's

Authenticatie & Instellen

Toegang vereist een geldige API-sleutel gekoppeld aan je account. Je genereert deze sleutel op de API-sleutel ophalen-pagina na het inloggen met e-mail en wachtwoord. De sleutel wordt direct na het aanmaken weergegeven. Om van een leverancier zoals OpenAI over te stappen, pas je de clientconfiguratie aan om naar onze basis-URL te verwijzen: https://api.unfilteredaimodels.com/v1 en voeg je je unieke API-sleutel toe. We ondersteunen de standaard Authorization-headerindeling.

Chat Completies Endpoint

De primaire interface is het POST /v1/chat/completions-endpoint. Het accepteert standaard berichtobjecten en retourneert tekstantwoorden. De model-ID die je moet opgeven is uncensored. Dit endpoint verwerkt ruwe tekstgeneratie zonder de gebruikelijke corporatieve veiligheidsmuren, waardoor volwassen, controversiële of creatieve inhoud binnen wettelijke grenzen mogelijk is. Je kunt je eerste verzoek verzenden met het volgende voorbeeld:

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Dit verzoek demonstreert het verzenden van een eenvoudig systeem-prompt en een gebruikersvraag om een antwoord te genereren.

Python SDK Integratie

Gebruik het officiële openai Python-pakket. Initialiseer de client met onze basis-URL en je API-sleutel. Roep vervolgens chat.completions.create aan met de model-ID uncensored. Deze aanpak vereist geen code-aanpassingen als je al het OpenAI SDK gebruikt voor andere diensten. De volgende codefragmenten tonen hoe je de client initialiseert en een verzoek verzendt:

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

De SDK verwerkt JSON-serialisatie en respons parsing automatisch.

Node.js SDK Integratie

Voor JavaScript-omgevingen gebruik je het openai Node.js-pakket. Configureer de basePath naar ons endpoint en geef je API-sleutel op. Roep de methode chat.completions.create aan met de model-ID uncensored. Dit zorgt voor compatibiliteit met bestaande Node.js-applicaties die OpenAI-standaardresponsen verwachten. Zo stel je de client in:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Deze opstelling zorgt ervoor dat je Node-applicatie kan communiceren met ons ongecensureerde model met behulp van bekende patronen.

Streaming Antwoorden

Stel de parameter stream in op true om server-sent events (SSE) te ontvangen. Hierdoor kun je tokens verwerken zodra ze worden gegenereerd, wat de waargenomen vertraging bij lange antwoorden vermindert. De API retourneert een stream van chunks, waarbij elke chunk gedeeltelijke responsdeltas bevat. Gebruik het volgende voorbeeld om streaming te implementeren:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Streaming is ideaal voor chatinterfaces waar gebruikers verwachten tekst in real-time te zien verschijnen.

Rate Limits & Kwota's

Je API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 Too Many Requests-fout. Je kunt je sleutel op elk moment opnieuw genereren via je dashboard, waardoor de oude sleutel ongeldig wordt en er een nieuwe wordt gegenereerd met een nieuwe rate limit-teller. Andere fouten zijn 401 voor ongeldige sleutels en 402 als je prepaid tegoed op is. Het contextvenster ondersteunt tot 100.000 tokens voor prompt en completion samen. Aanvraaglichamen zijn beperkt tot 8 MB.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.unfilteredaimodels.com/v1
Model-IDuncensored
JSON-modusresponse_format: {"type": "json_object"}
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Bonus+5% vanaf $50, +10% vanaf $100
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Reset mijn rate limit als ik mijn API-sleutel regeneer?

Ja. Het opnieuw genereren van je sleutel maakt de oude sleutel ongeldig en genereert een nieuwe met een nieuwe rate limit-teller. De limiet van 300 verzoeken per minuut geldt voor de specifieke sleutel die je gebruikt.

Welke inhoud is beperkt?

Het model weigert de meeste volwassen, fictieve of controversiële onderwerpen niet. Er geldt echter altijd een harde limiet: seksuele inhoud met minderjarigen wordt geblokkeerd.

Is het model gefinetuned of een standaard GPT?

Het is een open-weight model dat op onze eigen GPU-servers draait, afgestemd op ongecensureerde output. Het is geen GPT, Claude of een model van een andere leverancier.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele configuratie.