DE ▾
API-Schlüssel erhalten

Dokumentation zur unzensierten Chat-Vervollständigungs-API

Diese Dokumentation führt dich durch die Integration unseres unzensierten LLM über den standardmäßigen OpenAI-kompatiblen Chat-Endpunkt. Du kannst sofort mit der Textgenerierung beginnen, indem du deinen Client mit unserer Basis-URL und einem frisch generierten API-Schlüssel konfigurierst.

Auf dieser Seite
  1. Authentifizierung & Einrichtung
  2. Chat-Vervollständigungs-Endpunkt
  3. Python-SDK-Integration
  4. Node.js-SDK-Integration
  5. Streaming-Antworten
  6. Ratenlimits & Kontingente

Authentifizierung & Einrichtung

Der Zugriff erfordert einen gültigen API-Schlüssel, der mit deinem Konto verknüpft ist. Du generierst diesen Schlüssel auf der API-Schlüssel erhalten-Seite nach der Anmeldung mit E-Mail und Passwort. Der Schlüssel wird direkt nach der Erstellung angezeigt. Um von einem Anbieter wie OpenAI zu wechseln, aktualisiere die Client-Konfiguration, um auf unsere Basis-URL zu verweisen: https://api.unfilteredaimodels.com/v1 und gib deinen eindeutigen API-Schlüssel an. Wir unterstützen das Standardformat des Authorization-Headers.

Chat-Vervollständigungs-Endpunkt

Die primäre Schnittstelle ist der Endpunkt POST /v1/chat/completions. Er akzeptiert Standard-Nachrichtenobjekte und gibt Textantworten zurück. Die anzugebende Modell-ID ist uncensored. Dieser Endpunkt verarbeitet die Rohtextgenerierung ohne die typischen Unternehmenssicherungen und ermöglicht erwachsene, kontroverse oder kreative Inhalte innerhalb der gesetzlichen Grenzen. Du kannst deine erste Anfrage mit dem folgenden Beispiel senden:

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Diese Anfrage demonstriert das Senden eines einfachen System-Prompts und einer Benutzerabfrage zur Generierung einer Antwort.

Python-SDK-Integration

Verwende das offizielle Python-Paket openai. Initialisiere den Client mit unserer Basis-URL und deinem API-Schlüssel. Rufe dann chat.completions.create mit der Modell-ID uncensored auf. Dieser Ansatz erfordert null Codeänderungen, wenn du das OpenAI SDK bereits für andere Dienste nutzt. Das folgende Snippet zeigt, wie du den Client initialisierst und eine Anfrage sendest:

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Das SDK verarbeitet die JSON-Serialisierung und Antwortanalyse automatisch.

Node.js-SDK-Integration

Verwende für JavaScript-Umgebungen das Node-Paket openai. Konfiguriere basePath mit unserem Endpunkt und gib deinen API-Schlüssel an. Rufe die Methode chat.completions.create mit der Modell-ID uncensored auf. Dies gewährleistet die Kompatibilität mit bestehenden Node.js-Anwendungen, die OpenAI-Standardantworten erwarten. So richtest du den Client ein:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Diese Einrichtung stellt sicher, dass deine Node-Anwendung mit unserem unzensierten Modell über vertraute Muster kommunizieren kann.

Streaming-Antworten

Setze den Parameter stream auf true, um Server-Sent Events (SSE) zu empfangen. Dies ermöglicht die Verarbeitung von Token, sobald sie generiert werden, und reduziert die wahrgenommene Latenz bei langen Antworten. Die API gibt einen Stream von Chunks zurück, die jeweils teilweise Antwort-Deltas enthalten. Verwende das folgende Beispiel, um Streaming zu implementieren:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Streaming ist ideal für Chat-Schnittstellen, bei denen Benutzer erwarten, Text in Echtzeit erscheinen zu sehen.

Ratenlimits & Kontingente

Dein API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Wenn du dieses Limit überschreitest, erhältst du einen 429 Too Many Requests-Fehler. Du kannst deinen Schlüssel jederzeit über dein Dashboard neu generieren, wodurch der alte widerrufen und ein neuer mit einem neuen Ratenlimit-Zähler bereitgestellt wird. Weitere Fehler sind 401 für ungültige Schlüssel und 402, wenn dein Prepaid-Guthaben aufgebraucht ist. Das Kontextfenster unterstützt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Anforderungstexte sind auf 8 MB begrenzt.

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.unfilteredaimodels.com/v1
Modell-IDuncensored
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Ratenlimit300 Anfragen pro Minute und Schlüssel
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Bonus+5 % ab $50, +10 % ab $100
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Setzt das Zurücksetzen meines API-Schlüssels mein Ratenlimit zurück?

Ja. Wenn du deinen Schlüssel neu generierst, wird der alte widerrufen und ein neuer mit einem frischen Ratenlimit-Zähler ausgestellt. Das Limit von 300 Anfragen pro Minute gilt für den jeweils verwendeten Schlüssel.

Welcher Inhalt ist eingeschränkt?

Das Modell lehnt die meisten erwachsenen, fiktiven oder kontroversen Themen nicht ab. Es gilt jedoch immer eine harte Grenze: Sexuelle Inhalte mit Minderjährigen werden blockiert.

Ist das Modell feinabgestimmt oder ein Standard-GPT?

Es ist ein Open-Weight-Modell, das auf unseren eigenen GPU-Servern läuft und für unzensierte Ausgaben optimiert ist. Es ist kein GPT, Claude oder ein Modell eines anderen Anbieters.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.