Documentação da API de Completions de Chat sem censura
Esta documentação orienta você na integração do nosso LLM sem censura por meio do endpoint padrão de chat completions compatível com OpenAI. Você pode começar a gerar texto imediatamente configurando seu cliente com nossa URL base e uma chave de API recém-gerada.
Nesta página
Autenticação e Configuração
O acesso requer uma chave de API válida associada à sua conta. Você gera esta chave na página Obter Chave de API após se registrar com e-mail e senha. A chave é exibida imediatamente após a criação. Para migrar de um fornecedor como OpenAI, atualize a configuração do seu cliente para apontar para nossa URL base: https://api.unfilteredaimodels.com/v1 e forneça sua chave de API exclusiva. Suportamos o formato padrão do cabeçalho Authorization.
Endpoint de Completions de Chat
A interface principal é o endpoint POST /v1/chat/completions. Ele aceita objetos de mensagem padrão e retorna respostas de texto. O ID do modelo a ser especificado é uncensored. Este endpoint lida com geração de texto bruto sem as proteções corporativas típicas, permitindo conteúdo adulto, controverso ou criativo dentro dos limites legais. Você pode enviar sua primeira solicitação usando o exemplo a seguir:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Esta solicitação demonstra o envio de um prompt de sistema simples e uma consulta de usuário para gerar uma resposta.
Integração com SDK Python
Use o pacote Python oficial openai. Inicialize o cliente com nossa URL base e sua chave de API. Em seguida, chame chat.completions.create com o ID do modelo uncensored. Esta abordagem requer zero alterações de código se você já estiver usando o SDK OpenAI para outros serviços. O snippet a seguir mostra como inicializar o cliente e enviar uma solicitação:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
O SDK lida com a serialização JSON e a análise da resposta automaticamente.
Integração com SDK Node.js
Para ambientes JavaScript, use o pacote Node openai. Configure o basePath para nosso endpoint e forneça sua chave de API. Chame o método chat.completions.create com o ID do modelo uncensored. Isso garante compatibilidade com aplicativos Node.js existentes que esperam respostas padrão OpenAI. Veja como configurar o cliente:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Esta configuração garante que seu aplicativo Node possa se comunicar com nosso modelo sem censura usando padrões familiares.
Respostas em Streaming
Defina o parâmetro stream como true para receber eventos enviados pelo servidor (SSE). Isso permite processar tokens à medida que são gerados, reduzindo a latência percebida para respostas longas. A API retorna um fluxo de chunks, cada um contendo deltas parciais da resposta. Use o exemplo a seguir para implementar streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
O streaming é ideal para interfaces de chat onde os usuários esperam ver o texto aparecendo em tempo real.
Limites de Requisição e Cotas
Sua chave de API está limitada a 300 requisições por minuto. Se você exceder esse limite, receberá o erro 429 Too Many Requests. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga a chave antiga e fornece uma nova com um contador de limite de requisições zerado. Outros erros incluem 401 para chaves inválidas e 402 se seu crédito pré-pago estiver esgotado. A janela de contexto suporta até 100.000 tokens para prompt e conclusão combinados. Os corpos das requisições são limitados a 8 MB.
Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| ID do modelo | uncensored |
| Modo JSON | response_format: {"type": "json_object"} |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Validade | crédito pago não expira, sem assinatura |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
A regeneração da minha chave de API redefine o limite de requisições?
Sim. Regenerar sua chave revoga a antiga e emite uma nova com um contador de limite de requisições zerado. O limite de 300 requisições por minuto aplica-se à chave específica em uso.
Qual conteúdo é restringido?
O modelo não recusa a maioria dos tópicos adultos, fictícios ou controversos. No entanto, um limite rígido sempre se aplica: conteúdo sexual envolvendo menores é bloqueado.
O modelo é finetuned ou um GPT padrão?
É um modelo de pesos abertos executado em nossos próprios servidores GPU, ajustado para saída sem censura. Não é GPT, Claude ou qualquer outro modelo de fornecedor.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.