무검열 채팅 완성 API 문서
이 문서는 표준 OpenAI 호환 채팅 완성 엔드포인트를 통해 무검열 LLM을 통합하는 방법을 안내합니다. 기본 URL과 새로 생성된 API 키로 클라이언트를 구성하면 즉시 텍스트 생성을 시작할 수 있습니다.
인증 및 설정
액세스하려면 계정에 연결된 유효한 API 키가 필요합니다. 이메일과 비밀번호로 가입한 후 API 키 가져오기 페이지에서 이 키를 생성합니다. 키는 생성 즉시 표시됩니다. OpenAI와 같은 벤더에서 전환하려면 클라이언트 구성을 기본 URL로 업데이트하십시오: https://api.unfilteredaimodels.com/v1 그리고 고유한 API 키를 제공하십시오. 표준 Authorization 헤더 형식을 지원합니다.
채팅 완성 엔드포인트
주요 인터페이스는 POST /v1/chat/completions 엔드포인트입니다. 표준 메시지 객체를 받아들이고 텍스트 응답을 반환합니다. 지정할 모델 ID는 uncensored입니다. 이 엔드포인트는 일반적인 기업용 가드레일 없이 원시 텍스트 생성을 처리하여 법적 범위 내에서 성인, 논쟁적이거나 창의적인 콘텐츠를 허용합니다. 다음 예제를 사용하여 첫 번째 요청을 보낼 수 있습니다:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
이 요청은 간단한 시스템 프롬프트와 사용자 쿼리를 보내 응답을 생성하는 방법을 보여줍니다.
Python SDK 통합
공식 openai Python 패키지를 사용하십시오. 기본 URL과 API 키로 클라이언트를 초기화한 다음 모델 ID uncensored로 chat.completions.create를 호출하십시오. 이 방법은 이미 다른 서비스에 OpenAI SDK를 사용하고 있다면 코드 변경이 필요하지 않습니다. 다음 스니펫은 클라이언트 초기화 및 요청 보내는 방법을 보여줍니다:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK는 JSON 직렬화 및 응답 파싱을 자동으로 처리합니다.
Node.js SDK 통합
JavaScript 환경에서는 openai Node 패키지를 사용하십시오. basePath을 엔드포인트로 구성하고 API 키를 제공하십시오. uncensored 모델 ID로 chat.completions.create 메서드를 호출하십시오. 이는 OpenAI 표준 응답을 기대하는 기존 Node.js 애플리케이션과의 호환성을 보장합니다. 클라이언트 설정 방법은 다음과 같습니다:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
이 설정은 Node 애플리케이션이 친숙한 패턴을 사용하여 무검열 모델과 통신할 수 있도록 보장합니다.
스트리밍 응답
서버 전송 이벤트(SSE)를 받으려면 stream 매개변수를 true로 설정하십시오. 이렇게 하면 생성되는 대로 토큰을 처리하여 긴 응답의 지각된 지연 시간을 줄일 수 있습니다. API는 응답의 부분적인 델타를 각각 포함하는 청크의 스트림을 반환합니다. 스트리밍 구현에는 다음 예제를 사용하십시오:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
스트리밍은 사용자가 실시간으로 텍스트가 나타나는 것을 기대하는 채팅 인터페이스에 이상적입니다.
속도 제한 및 할당량
API 키는 분당 300회 요청으로 제한됩니다. 이를 초과하면 429 Too Many Requests 오류가 발생합니다. 대시보드에서 언제든지 키를 재생성할 수 있으며, 이는 기존 키를 무효화하고 새 속도 제한 카운터가 있는 새 키를 제공합니다. 다른 오류로는 유효하지 않은 키에 대한 401 및 선불 크레딧이 고갈된 경우 402이 있습니다. 컨텍스트 창은 프롬프트와 완성을 합쳐 최대 100,000개의 토큰을 지원합니다. 요청 본문은 8 MB로 제한됩니다.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 인증 | Authorization: Bearer YOUR_KEY |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| 모델 ID | uncensored |
| JSON 모드 | response_format: {"type": "json_object"} |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 속도 제한 | 키당 분당 300회 |
| 동시 요청 | 키당 동시 8개 |
| 요청 크기 | 최대 8 MB |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
API 키를 재생성하면 속도 제한이 초기화되나요?
네. 키를 재생성하면 기존 키가 무효화되고 새 속도 제한 카운터가 적용된 새 키가 발급됩니다. 분당 300회 제한은 사용 중인 특정 키에 적용됩니다.
어떤 콘텐츠가 제한되나요?
모델은 대부분의 성인, 픽션 또는 논쟁적인 주제를 거부하지 않습니다. 그러나 항상 하드 리미트가 적용됩니다: 미성년자가 포함된 성적인 콘텐츠는 차단됩니다.
모델이 파인튜닝된 것이나 표준 GPT인가요?
이것은 무검열 출력을 위해 조정된 자체 GPU 서버에서 실행되는 오픈 웨이트 모델입니다. GPT, Claude 또는 기타 벤더의 모델이 아닙니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 다음 기본 URL을 변경하십시오. 이것이 전체 설정입니다.