PT ▾
Obter chave de API

Documentação da API de Completions de Chat sem censura

Esta documentação orienta você na integração do nosso LLM sem censura por meio do endpoint padrão de chat completions compatível com OpenAI. Você pode começar a gerar texto imediatamente configurando seu cliente com nossa URL base e uma chave de API recém-gerada.

Nesta página
  1. Autenticação e Configuração
  2. Endpoint de Completions de Chat
  3. Integração com SDK Python
  4. Integração com SDK Node.js
  5. Respostas em Streaming
  6. Limites de Requisição e Cotas

Autenticação e Configuração

O acesso requer uma chave de API válida associada à sua conta. Você gera esta chave na página Obter Chave de API após se registrar com e-mail e senha. A chave é exibida imediatamente após a criação. Para migrar de um fornecedor como OpenAI, atualize a configuração do seu cliente para apontar para nossa URL base: https://api.unfilteredaimodels.com/v1 e forneça sua chave de API exclusiva. Suportamos o formato padrão do cabeçalho Authorization.

Endpoint de Completions de Chat

A interface principal é o endpoint POST /v1/chat/completions. Ele aceita objetos de mensagem padrão e retorna respostas de texto. O ID do modelo a ser especificado é uncensored. Este endpoint lida com geração de texto bruto sem as proteções corporativas típicas, permitindo conteúdo adulto, controverso ou criativo dentro dos limites legais. Você pode enviar sua primeira solicitação usando o exemplo a seguir:

curl https://api.unfilteredaimodels.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Esta solicitação demonstra o envio de um prompt de sistema simples e uma consulta de usuário para gerar uma resposta.

Integração com SDK Python

Use o pacote Python oficial openai. Inicialize o cliente com nossa URL base e sua chave de API. Em seguida, chame chat.completions.create com o ID do modelo uncensored. Esta abordagem requer zero alterações de código se você já estiver usando o SDK OpenAI para outros serviços. O snippet a seguir mostra como inicializar o cliente e enviar uma solicitação:

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

O SDK lida com a serialização JSON e a análise da resposta automaticamente.

Integração com SDK Node.js

Para ambientes JavaScript, use o pacote Node openai. Configure o basePath para nosso endpoint e forneça sua chave de API. Chame o método chat.completions.create com o ID do modelo uncensored. Isso garante compatibilidade com aplicativos Node.js existentes que esperam respostas padrão OpenAI. Veja como configurar o cliente:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Esta configuração garante que seu aplicativo Node possa se comunicar com nosso modelo sem censura usando padrões familiares.

Respostas em Streaming

Defina o parâmetro stream como true para receber eventos enviados pelo servidor (SSE). Isso permite processar tokens à medida que são gerados, reduzindo a latência percebida para respostas longas. A API retorna um fluxo de chunks, cada um contendo deltas parciais da resposta. Use o exemplo a seguir para implementar streaming:

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

O streaming é ideal para interfaces de chat onde os usuários esperam ver o texto aparecendo em tempo real.

Limites de Requisição e Cotas

Sua chave de API está limitada a 300 requisições por minuto. Se você exceder esse limite, receberá o erro 429 Too Many Requests. Você pode regenerar sua chave a qualquer momento no seu painel, o que revoga a chave antiga e fornece uma nova com um contador de limite de requisições zerado. Outros erros incluem 401 para chaves inválidas e 402 se seu crédito pré-pago estiver esgotado. A janela de contexto suporta até 100.000 tokens para prompt e conclusão combinados. Os corpos das requisições são limitados a 8 MB.

Especificações técnicas

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.unfilteredaimodels.com/v1
ID do modelouncensored
Modo JSONresponse_format: {"type": "json_object"}
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Janela de contexto100.000 tokens (entrada + saída)
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Validadecrédito pago não expira, sem assinatura
Bônus+5% a partir de $50, +10% a partir de $100
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

A regeneração da minha chave de API redefine o limite de requisições?

Sim. Regenerar sua chave revoga a antiga e emite uma nova com um contador de limite de requisições zerado. O limite de 300 requisições por minuto aplica-se à chave específica em uso.

Qual conteúdo é restringido?

O modelo não recusa a maioria dos tópicos adultos, fictícios ou controversos. No entanto, um limite rígido sempre se aplica: conteúdo sexual envolvendo menores é bloqueado.

O modelo é finetuned ou um GPT padrão?

É um modelo de pesos abertos executado em nossos próprios servidores GPU, ajustado para saída sem censura. Não é GPT, Claude ou qualquer outro modelo de fornecedor.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.