Dokumentacja API Uzupełnień Czat Bez Cenzury
Dokumentacja prowadzi Cię przez integrację naszego LLM bez cenzury przez standardowy endpoint uzupełnień czatu zgodny z OpenAI. Możesz zacząć generować tekst natychmiast, konfigurując klienta pod nasz bazowy URL i świeżo wygenerowany klucz API.
Na tej stronie
Uwierzytelnianie i Konfiguracja
Dostęp wymaga ważnego klucza API powiązanego z Twoim kontem. Generujesz ten klucz na stronie Pobierz klucz API po zalogowaniu się e-mailem i hasłem. Klucz jest wyświetlany natychmiast po utworzeniu. Aby przełączyć się z dostawcą takim jak OpenAI, zaktualizuj konfigurację klienta, aby wskazywała nasz bazowy URL: https://api.unfilteredaimodels.com/v1 i podaj swój unikalny klucz API. Obsługujemy standardowy format nagłówka Authorization.
Endpoint Uzupełnień Czat
Podstawowym interfejsem jest endpoint POST /v1/chat/completions. Przyjmuje standardowe obiekty wiadomości i zwraca odpowiedzi tekstowe. ID modelu do podania to uncensored. Endpoint ten obsługuje generowanie surowego tekstu bez typowych korporacyjnych ograniczeń, pozwalając na treści dla dorosłych, kontrowersyjne lub kreatywne w granicach prawa. Możesz wysłać swoje pierwsze zapytanie, korzystając z poniższego przykładu:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
To zapytanie demonstruje wysyłanie prostego promptu systemowego i zapytania użytkownika w celu wygenerowania odpowiedzi.
Integracja SDK Python
Użyj oficjalnego pakietu Python openai. Zainicjuj klienta naszym bazowym URL i kluczem API. Następnie wywołaj chat.completions.create z ID modelu uncensored. To podejście wymaga zerowych zmian w kodzie, jeśli już używasz SDK OpenAI dla innych usług. Poniższy fragment pokazuje, jak zainicjować klienta i wysłać zapytanie:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK obsługuje serializację JSON i parsowanie odpowiedzi automatycznie.
Integracja SDK Node.js
W środowiskach JavaScript użyj pakietu Node openai. Skonfiguruj basePath do naszego endpointu i podaj swój klucz API. Wywołaj metodę chat.completions.create z ID modelu uncensored. Zapewnia to kompatybilność z istniejącymi aplikacjami Node.js oczekującymi odpowiedzi zgodnych ze standardem OpenAI. Oto jak skonfigurować klienta:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ta konfiguracja zapewnia, że Twoja aplikacja Node może komunikować się z naszym modelem bez cenzury używając znanych wzorców.
Odpowiedzi Strumieniowe
Ustaw parametr stream na true, aby otrzymywać zdarzenia wysyłane przez serwer (SSE). Pozwala to przetwarzać tokeny w miarę ich generowania, co zmniejsza postrzeganą opóźnienie przy długich odpowiedziach. API zwraca strumień cząstek, z których każda zawiera częściowe delty odpowiedzi. Użyj poniższego przykładu, aby zaimplementować strumieniowanie:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Strumieniowanie jest idealne dla interfejsów czat, gdzie użytkownicy oczekują widzenia tekstu pojawiającego się w czasie rzeczywistym.
Limity Zapytań i Kwoty
Twój klucz API jest ograniczony do 300 zapytań na minutę. Jeśli przekroczysz ten limit, otrzymasz błąd 429 Too Many Requests. Możesz wygenerować klucz ponownie w dowolnym momencie z pulpitu nawigacyjnego, co unieważni stary klucz i dostarczy nowy z nowym licznikiem limitu zapytań. Inne błędy obejmują 401 dla nieprawidłowych kluczy i 402 jeśli Twój przedpłacony kredyt został wyczerpany. Okno kontekstu obsługuje do 100 000 tokenów dla promptu i uzupełnienia łącznie. Ciała zapytań są ograniczone do 8 MB.
Specyfikacja techniczna
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| ID modelu | uncensored |
| Tryb JSON | response_format: {"type": "json_object"} |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Bonus | +5% od $50, +10% od $100 |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy regeneracja klucza API resetuje limit zapytań?
Tak. Regeneracja klucza unieważnia stary i wydaje nowy z świeżym licznikiem limitu zapytań. Limit 300 zapytań na minutę dotyczy konkretnego używanego klucza.
Jakie treści są ograniczone?
Model nie odrzuca większości tematów dla dorosłych, fikcyjnych lub kontrowersyjnych. Zawsze jednak obowiązuje twardy limit: treści seksualne z udziałem małoletnich są blokowane.
Czy model jest dostrojony, czy standardowy GPT?
To model o otwartych wagach uruchomiony na własnych serwerach GPU, dostrojony do wyjść bez cenzury. Nie jest to GPT, Claude ani model żadnego innego dostawcy.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.