Documentación de la API de completados de chat sin censura
Esta documentación te guía por la integración de nuestro LLM sin censura a través del endpoint estándar de completados de chat compatible con OpenAI. Puedes empezar a generar texto inmediatamente configurando tu cliente con nuestra URL base y una clave de API recién generada.
En esta página
Autenticación y configuración
El acceso requiere una clave de API válida asociada a tu cuenta. Generas esta clave en la página Obtener clave de API después de registrarte con un correo electrónico y contraseña. La clave se muestra inmediatamente tras su creación. Para cambiar de un proveedor como OpenAI, actualiza la configuración de tu cliente para apuntar a nuestra URL base: https://api.unfilteredaimodels.com/v1 y proporciona tu clave de API única. Admitimos el formato estándar del encabezado Authorization.
Endpoint de completados de chat
La interfaz principal es el endpoint POST /v1/chat/completions. Acepta objetos de mensaje estándar y devuelve respuestas de texto. El ID de modelo a especificar es uncensored. Este endpoint maneja la generación de texto sin las barreras corporativas típicas, permitiendo contenido para adultos, controvertido o creativo dentro de los límites legales. Puedes enviar tu primera petición usando el siguiente ejemplo:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Esta petición demuestra el envío de un prompt de sistema simple y una consulta de usuario para generar una respuesta.
Integración con SDK de Python
Usa el paquete de Python oficial openai. Inicializa el cliente con nuestra URL base y tu clave de API. Luego llama a chat.completions.create con el ID de modelo uncensored. Este enfoque requiere cero cambios de código si ya estás usando el SDK de OpenAI para otros servicios. El siguiente fragmento muestra cómo inicializar el cliente y enviar una petición:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
El SDK maneja la serialización JSON y el análisis de respuestas automáticamente.
Integración con SDK de Node.js
Para entornos JavaScript, usa el paquete Node openai. Configura el basePath hacia nuestro endpoint y proporciona tu clave de API. Llama al método chat.completions.create con el ID de modelo uncensored. Esto garantiza la compatibilidad con aplicaciones Node.js existentes que esperan respuestas estándar de OpenAI. Así es cómo configurar el cliente:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Esta configuración asegura que tu aplicación Node pueda comunicarse con nuestro modelo sin censura usando patrones familiares.
Respuestas en streaming
Establece el parámetro stream en true para recibir eventos enviados por el servidor (SSE). Esto te permite procesar tokens a medida que se generan, reduciendo la latencia percibida para respuestas largas. La API devuelve un flujo de fragmentos, cada uno conteniendo deltas parciales de la respuesta. Usa el siguiente ejemplo para implementar streaming:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
El streaming es ideal para interfaces de chat donde los usuarios esperan ver texto apareciendo en tiempo real.
Límites de peticiones y cuotas
Tu clave de API está limitada a 300 peticiones por minuto. Si excedes este límite, recibirás un error 429 Too Many Requests. Puedes regenerar tu clave en cualquier momento desde tu panel, lo que revocará la clave anterior y proporcionará una nueva con un contador de límite de peticiones fresco. Otros errores incluyen 401 para claves inválidas y 402 si tu crédito prepago se agota. La ventana de contexto admite hasta 100.000 tokens para prompt y finalización combinados. Los cuerpos de las peticiones están limitados a 8 MB.
Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| ID del modelo | uncensored |
| Modo JSON | response_format: {"type": "json_object"} |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Bono | +5 % desde $50, +10 % desde $100 |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Regenerar mi clave de API restablece mi límite de peticiones?
Sí. Regenerar tu clave revoca la anterior y emite una nueva con un contador de límite de peticiones fresco. El límite de 300 peticiones por minuto se aplica a la clave específica en uso.
¿Qué contenido está restringido?
El modelo no rechaza la mayoría de los temas para adultos, ficticios o controversiales. Sin embargo, siempre se aplica un límite estricto: el contenido sexual que involucra a menores está bloqueado.
¿El modelo está ajustado o es un GPT estándar?
Es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU, ajustado para salida sin censura. No es GPT, Claude ni ningún otro modelo de proveedor.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Esa es toda la configuración.