KO ▾
API 키 받기

무검열 채팅 완성 API 문서

이 문서는 표준 OpenAI 호환 채팅 완성 엔드포인트를 통해 무검열 LLM을 통합하는 방법을 안내합니다. 기본 URL과 새로 생성된 API 키로 클라이언트를 구성하면 즉시 텍스트 생성을 시작할 수 있습니다.

이 페이지 내용
  1. 인증 및 설정
  2. 채팅 완성 엔드포인트
  3. Python SDK 통합
  4. Node.js SDK 통합
  5. 스트리밍 응답
  6. 속도 제한 및 할당량

인증 및 설정

액세스하려면 계정에 연결된 유효한 API 키가 필요합니다. 이메일과 비밀번호로 가입한 후 API 키 가져오기 페이지에서 이 키를 생성합니다. 키는 생성 즉시 표시됩니다. OpenAI와 같은 벤더에서 전환하려면 클라이언트 구성을 기본 URL로 업데이트하십시오: https://api.unfilteredaimodels.com/v1 그리고 고유한 API 키를 제공하십시오. 표준 Authorization 헤더 형식을 지원합니다.

채팅 완성 엔드포인트

주요 인터페이스는 POST /v1/chat/completions 엔드포인트입니다. 표준 메시지 객체를 받아들이고 텍스트 응답을 반환합니다. 지정할 모델 ID는 uncensored입니다. 이 엔드포인트는 일반적인 기업용 가드레일 없이 원시 텍스트 생성을 처리하여 법적 범위 내에서 성인, 논쟁적이거나 창의적인 콘텐츠를 허용합니다. 다음 예제를 사용하여 첫 번째 요청을 보낼 수 있습니다:

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

이 요청은 간단한 시스템 프롬프트와 사용자 쿼리를 보내 응답을 생성하는 방법을 보여줍니다.

Python SDK 통합

공식 openai Python 패키지를 사용하십시오. 기본 URL과 API 키로 클라이언트를 초기화한 다음 모델 ID uncensored로 chat.completions.create를 호출하십시오. 이 방법은 이미 다른 서비스에 OpenAI SDK를 사용하고 있다면 코드 변경이 필요하지 않습니다. 다음 스니펫은 클라이언트 초기화 및 요청 보내는 방법을 보여줍니다:

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

SDK는 JSON 직렬화 및 응답 파싱을 자동으로 처리합니다.

Node.js SDK 통합

JavaScript 환경에서는 openai Node 패키지를 사용하십시오. basePath을 엔드포인트로 구성하고 API 키를 제공하십시오. uncensored 모델 ID로 chat.completions.create 메서드를 호출하십시오. 이는 OpenAI 표준 응답을 기대하는 기존 Node.js 애플리케이션과의 호환성을 보장합니다. 클라이언트 설정 방법은 다음과 같습니다:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

이 설정은 Node 애플리케이션이 친숙한 패턴을 사용하여 무검열 모델과 통신할 수 있도록 보장합니다.

스트리밍 응답

서버 전송 이벤트(SSE)를 받으려면 stream 매개변수를 true로 설정하십시오. 이렇게 하면 생성되는 대로 토큰을 처리하여 긴 응답의 지각된 지연 시간을 줄일 수 있습니다. API는 응답의 부분적인 델타를 각각 포함하는 청크의 스트림을 반환합니다. 스트리밍 구현에는 다음 예제를 사용하십시오:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

스트리밍은 사용자가 실시간으로 텍스트가 나타나는 것을 기대하는 채팅 인터페이스에 이상적입니다.

속도 제한 및 할당량

API 키는 분당 300회 요청으로 제한됩니다. 이를 초과하면 429 Too Many Requests 오류가 발생합니다. 대시보드에서 언제든지 키를 재생성할 수 있으며, 이는 기존 키를 무효화하고 새 속도 제한 카운터가 있는 새 키를 제공합니다. 다른 오류로는 유효하지 않은 키에 대한 401 및 선불 크레딧이 고갈된 경우 402이 있습니다. 컨텍스트 창은 프롬프트와 완성을 합쳐 최대 100,000개의 토큰을 지원합니다. 요청 본문은 8 MB로 제한됩니다.

기술 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
인증Authorization: Bearer YOUR_KEY
엔드포인트POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.unfilteredaimodels.com/v1
모델 IDuncensored
JSON 모드response_format: {"type": "json_object"}
최대 출력100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
컨텍스트 창100,000 토큰 (입력 + 출력)
속도 제한키당 분당 300회
동시 요청키당 동시 8개
요청 크기최대 8 MB
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
유효기간유료 크레딧은 만료되지 않으며 구독 없음
보너스$50 이상 +5%, $100 이상 +10%
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
로그인Google 또는 이메일과 비밀번호
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

API 키를 재생성하면 속도 제한이 초기화되나요?

네. 키를 재생성하면 기존 키가 무효화되고 새 속도 제한 카운터가 적용된 새 키가 발급됩니다. 분당 300회 제한은 사용 중인 특정 키에 적용됩니다.

어떤 콘텐츠가 제한되나요?

모델은 대부분의 성인, 픽션 또는 논쟁적인 주제를 거부하지 않습니다. 그러나 항상 하드 리미트가 적용됩니다: 미성년자가 포함된 성적인 콘텐츠는 차단됩니다.

모델이 파인튜닝된 것이나 표준 GPT인가요?

이것은 무검열 출력을 위해 조정된 자체 GPU 서버에서 실행되는 오픈 웨이트 모델입니다. GPT, Claude 또는 기타 벤더의 모델이 아닙니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 다음 기본 URL을 변경하십시오. 이것이 전체 설정입니다.