Guía de inicio rápido de la API de Unrestricted AI
Integra la API de Unrestricted AI con una única URL base y SDK estándar compatibles con OpenAI. Obtén salidas del modelo sin censura sin rechazos de contenido ni sobrecarga de enrutamiento de modelos.
- base_url
- https://api.unrestrictedai.cc/v1
- Modelo
- sin censura
Autenticación y URL base
La API de Unrestricted AI utiliza autenticación estándar con token bearer. Obtienes tu clave de API inmediatamente después de registrarte con Google o una dirección de correo electrónico en la página Obtener clave de API. No se requiere número de teléfono. Utiliza la URL base https://api.unrestrictedai.cc/v1 para todas las peticiones. Esta URL funciona con los SDK oficiales de OpenAI y cualquier cliente compatible con OpenAI simplemente actualizando la configuración de base_url. Tu clave otorga acceso al modelo sin censura identificado por el ID uncensored. Se trata de un único modelo de pesos abiertos que se ejecuta en nuestros propios servidores, no es GPT, Claude ni ningún otro modelo de otro proveedor. No realizamos enrutamiento de modelos, lo que garantiza un acceso de baja latencia a un modelo ajustado para contenido adulto y sin filtrar, sin la sobrecarga de una interfaz de chat web. La clave de API es única por cuenta; generar una nueva clave reemplaza a la anterior.
Petición básica de chat
Envía una petición POST a /v1/chat/completions con tus mensajes y el ID del modelo. El siguiente ejemplo demuestra una interacción estándar de entrada y salida de texto utilizando la herramienta de línea de comandos cURL. Reemplaza YOUR_API_KEY con tu clave real. El ID del modelo debe establecerse en uncensored. Este endpoint devuelve la respuesta del modelo en formato JSON. Asegúrate de procesar el cuerpo de la respuesta para extraer el contenido del mensaje del asistente. Esta petición básica es la base para construir aplicaciones que requieran respuestas de LLM sin filtrar sin rechazos de contenido ni sobrecarga de enrutamiento de modelos.
Integración con SDK de Python
El uso del SDK oficial de Python simplifica la integración con la API sin censura. Configura el cliente con la URL base correcta y tu clave de API. El siguiente código muestra cómo instanciar el cliente y enviar una petición a la API de LLM sin censura. Este enfoque es ideal para servicios backend o scripts donde necesitas control programático sobre los parámetros de la petición. El SDK maneja automáticamente la serialización JSON y las conexiones HTTP. Recuerda que el ID del modelo sigue siendo uncensored. Este método es eficiente para desarrolladores que prefieren interfaces tipadas y un manejo de errores robusto en sus aplicaciones de Python.
Uso del SDK de Node.js
Para entornos de JavaScript y TypeScript, el SDK de Node proporciona una forma nativa de interactuar con la API. Establece baseURL al endpoint y proporciona tu clave de API. El siguiente fragmento demuestra una petición de completion simple. Este patrón es adecuado para renderizado del lado del servidor o gateways de API. La estructura de la respuesta coincide con el formato de OpenAI, lo que facilita la migración del código existente de OpenAI. Asegúrate de manejar correctamente las respuestas asíncronas. La API de IA sin censura te permite cambiar de OpenAI a nuestro servicio con cambios mínimos de código, preservando la lógica de tu aplicación existente mientras obtienes acceso a contenido sin filtros.
Respuestas en streaming
Habilita el streaming estableciendo stream: true en tu petición. La API devuelve un flujo de eventos del servidor (SSE) con respuestas parciales. Esto es útil para interfaces de usuario en tiempo real donde deseas mostrar tokens a medida que se generan. El último fragmento del flujo contiene las estadísticas de uso de tokens. El streaming te permite comenzar a mostrar contenido al usuario antes de que la respuesta completa esté lista, mejorando la latencia percibida. Asegúrate de que tu cliente analice correctamente el formato SSE. Esta función está disponible para todas las peticiones a la API de IA sin censura, permitiéndote construir aplicaciones receptivas que manejen respuestas de LLM sin filtrar sin rechazos de contenido ni sobrecarga de enrutamiento de modelos.
Parámetros, límites y errores
La ventana de contexto es de 100.000 tokens en total, con una salida máxima de 32.000 tokens por petición. Si no se establece max_tokens, el límite es de 2.048 tokens. Puedes usar parámetros como temperature, top_p, stop y seed para controlar la generación. Los límites de velocidad son de 300 peticiones por minuto y 8 peticiones simultáneas por clave. Los cuerpos de las peticiones deben tener menos de 8 MB. Los errores comunes incluyen 401 (clave inválida), 402 (crédito insuficiente) y 429 (límite de velocidad). El crédito es prepago y no caduca. Los errores y rechazos son gratuitos. El único límite estricto de contenido es el contenido sexual que involucra a menores, que siempre se rechaza. No se necesita tarjeta para la prueba de $0,50 válida durante 7 días.
cURL
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestrictedai.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestrictedai.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Especificaciones técnicas
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.unrestrictedai.cc/v1 |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Modo JSON | response_format: {"type": "json_object"} |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Límite de peticiones | 300 por minuto por clave |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Bono | +5 % desde $50, +10 % desde $100 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es esta API un servicio oficial de OpenAI?
No. Ofrecemos un único modelo de pesos abiertos y sin censura a través de una interfaz estándar compatible con OpenAI. No es GPT, Claude, Gemini ni ningún otro modelo de otro proveedor. Es un servicio independiente que se ejecuta en nuestros propios servidores.
¿Cómo recargo mi crédito?
El crédito se recarga únicamente con criptomonedas: USDT (TRC20) o USDC (Base). La recarga mínima es de $10 y la máxima de $500. Obtienes un bono del +5% en recargas de $50 y del +10% en recargas de $100. No aceptamos tarjetas ni PayPal.
¿Cuál es el tamaño de la ventana de contexto?
La ventana de contexto es de 100.000 tokens para el prompt y la finalización combinados. La salida máxima por petición es de 32.000 tokens, o 2.048 tokens si no se especifica max_tokens.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave y cambia la URL base. Eso es todo el proceso de configuración.