ES ▾
Obtener clave de API

Cómo integrar la API de Unrestricted AI para salidas sin censura

Integrar una API de IA sin restricciones permite a los desarrolladores eludir los filtros de contenido en las salidas de LLM mediante un endpoint de modelo de pesos abiertos directo. Esta guía cubre la configuración técnica, los precios y las restricciones de implementación de una API de LLM sin censura para la generación de texto sin filtros.

Actualizado

Puntos clave

¿Por qué usar una API sin censura?

Los proveedores de LLM estándar suelen aplicar capas de moderación de contenido que rechazan prompts basándose en criterios subjetivos, como tropos de escritura creativa, temas políticos o temas para adultos. Para desarrolladores que construyen aplicaciones donde estos rechazos rompen la experiencia del usuario, una API de LLM sin censura proporciona un camino directo a las salidas del modelo sin estas barreras artificiales. Este servicio aloja un único modelo de pesos abiertos ajustado para responder sin rechazos de contenido para uso adulto lícito, garantizando un comportamiento consistente en diversos temas.

A diferencia de los agregadores que enrutan peticiones entre múltiples modelos de proveedores, este servicio utiliza infraestructura dedicada. Esto elimina la complejidad de gestionar múltiples claves de API y formatos de respuesta variables. El modelo no es GPT, Claude, Gemini ni ningún otro modelo de proveedor; es un modelo de pesos abiertos distinto que se ejecuta en nuestros servidores. Este enfoque reduce la latencia y garantiza que el comportamiento 'sin censura' sea consistente, ya que depende del ajuste del modelo base en lugar de una capa de moderación dinámica aplicada por un agregador de terceros.

Sin embargo, esta no es una solución universal. Si necesitas incrustaciones, generación de imágenes o múltiples opciones de modelos, esta API solo de texto puede no adaptarse a tu stack. Está diseñada específicamente para desarrolladores que necesitan salidas de texto sin procesar y quieren evitar la sobrecarga del enrutamiento de modelos o la imprevisibilidad de las interfaces de usuario de chat web.

Comprensión de la interfaz compatible con OpenAI

La API sigue el esquema estándar de chat-completions de OpenAI, lo que facilita la integración para desarrolladores ya familiarizados con los SDK de OpenAI. Interactúas con el endpoint utilizando métodos HTTP estándar, principalmente POST para completaciones y GET para información del modelo. La URL base es https://api.unrestrictedai.cc/v1, y puedes usar cualquier cliente compatible con OpenAI actualizando la base_url y proporcionando tu clave de API.

El endpoint principal es POST /v1/chat/completions, que acepta un array de mensajes y devuelve una respuesta de texto. Los endpoints adicionales incluyen GET /v1/models para listar modelos disponibles. No hay endpoints de incrustaciones, audio, video ni ajuste fino. Esta simplicidad reduce la curva de aprendizaje y te permite intercambiar el modelo sin censura con cambios mínimos de código.

  • Método: POST para completaciones, GET para información del modelo.
  • Formato: Cuerpo de petición JSON con array de mensajes.
  • Respuesta: Objeto JSON que contiene el texto generado.
  • Compatibilidad: Funciona con los SDK oficiales de OpenAI y clientes de terceros como LangChain o LlamaIndex.

Esta interfaz garantiza que tu código existente pueda aprovechar las capacidades sin censura sin necesidad de una reescritura completa. Tú controlas los parámetros, como temperature y top_p, para ajustar la creatividad y el determinismo de los resultados.

Configuración de tu clave de API de Unrestricted AI

Comenzar requiere una cuenta, que se puede crear mediante 'Continuar con Google' o registrándose con un correo electrónico y contraseña. No se requiere número de teléfono y el proceso está diseñado para la velocidad. Al registrarte, se te dirige a la página 'Obtener clave de API', donde tu clave de API se muestra inmediatamente. Esta clave se utiliza para autenticar todas las peticiones a la API.

Cada cuenta está limitada a una clave activa. Si generas una nueva clave, la anterior se invalida. Esto simplifica la gestión de seguridad, ya que no necesitas rastrear múltiples claves para una sola cuenta. La clave otorga acceso al modelo sin censura y se cobra según el uso real de tokens.

Créditos de prueba: Cada cuenta nueva recibe $0.50 de crédito de prueba, válido por 7 días. No se necesita tarjeta de crédito para reclamar esta prueba, lo que facilita probar la API antes de comprometerte con una compra. La prueba es una por persona y no se puede combinar con otras ofertas.

Privacidad: Tu cuenta solo requiere una dirección de correo electrónico. Los prompts enviados a la API no se usan para entrenamiento, lo que garantiza que tus datos permanezcan privados. Esta es una característica clave para desarrolladores que necesitan mantener la confidencialidad de los datos de entrada de su aplicación.

Realización de tu primera petición

Con tu clave de API y URL base listas, puedes realizar tu primera petición. La API acepta formatos de mensaje estándar, incluidos roles de system, user y assistant. Aquí hay un ejemplo usando cURL:


curl https://api.unrestrictedai.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Esta petición envía un prompt simple al modelo. La respuesta contendrá el texto generado, junto con estadísticas de uso de tokens. El id del modelo a enviar es 'uncensored'. Este identificador se utiliza en el cuerpo de la petición para especificar el modelo.

También puedes usar el SDK oficial de Python de OpenAI. Inicializa el cliente con tu URL base y clave de API, luego llama al método chat.completions.create. La estructura de la respuesta coincide con el formato de OpenAI, incluidas choices, finish_reason y estadísticas de uso.

Parámetros clave:

  • model: 'uncensored'
  • messages: Array de objetos de mensaje
  • temperature: Controla la aleatoriedad (predeterminado 1.0)
  • max_tokens: Máximo de tokens de salida (predeterminado 2048)

Esta configuración te permite integrar rápidamente el modelo sin censura en tu aplicación. El tiempo de respuesta es generalmente bajo, lo que refleja la infraestructura directa sin sobrecarga de enrutamiento.

Manejo de streaming y herramientas

La API admite streaming mediante Eventos Enviados por Servidor (SSE), que es esencial para experiencias de usuario en tiempo real. Cuando el streaming está habilitado, la API envía respuestas parciales a medida que se generan. El fragmento final contiene el uso total de tokens, lo que te permite rastrear los costos con precisión. Esto es útil para interfaces de chat que muestran texto a medida que se genera.

Las llamadas a funciones (herramientas) también son compatibles. Puedes definir herramientas en tu petición y el modelo devolverá una salida JSON estructurada que puede ser analizada y ejecutada por tu aplicación. Esto habilita flujos de trabajo complejos, como interactuar con APIs o bases de datos externas.

Modo JSON: Puedes forzar la salida JSON estableciendo response_format en json_object. Esto asegura que el modelo devuelva JSON válido, lo cual es crítico para su consumo programático.

Otros parámetros:

  • stop: Secuencias donde la API dejará de generar más tokens.
  • seed: Para salidas reproducibles.
  • presence_penalty: Anima al modelo a hablar sobre nuevos temas.
  • frequency_penalty: Penaliza los nuevos tokens basándose en su frecuencia existente en el texto.

Estas características hacen que la API sea adecuada para una amplia gama de aplicaciones, desde chatbots simples hasta sistemas basados en agentes complejos.

Precios y pagos con criptomonedas

El modelo de precios es sencillo y se basa en el uso. No hay tarifas mensuales ni suscripciones. Pagas por lo que usas:

  • Tokens de entrada: $0,25 por 1M de tokens
  • Tokens de salida: $1,00 por 1M de tokens

Los errores y las denegaciones son gratuitos, lo que significa que no pagas por los tokens que no se generan correctamente. El crédito es prepago y no caduca, por lo que puedes recargar según necesites. Este modelo es transparente y predecible, lo que te permite estimar los costos en función del uso de tokens esperado.

Proceso de recarga: Los pagos se aceptan solo mediante criptomonedas. Puedes recargar usando USDT (TRC20) o USDC (Base). La cantidad mínima de recarga es $10 y la máxima es $500. Se otorgan créditos bonificados por recargas más grandes:

  • Recarga de $50: +5% de crédito bonificado
  • Recarga de $100: +10% de crédito bonificado

No se emiten reembolsos para los saldos de crédito, pero los errores como cobros duplicados se pueden resolver a través de la página de Soporte. Este modelo exclusivo de criptomonedas reduce las tarifas de transacción y simplifica los pagos globales.

Límites de peticiones y cuotas

Para garantizar un uso justo y mantener el rendimiento, la API aplica los siguientes límites por clave de API:

  • Peticiones por minuto: 300
  • Peticiones simultáneas: 8
  • Tamaño máximo del cuerpo de la petición: 8 MB

Estos límites se aplican para prevenir el abuso y garantizar una latencia constante. Si superas el límite de peticiones, recibirás un error 429 Demasiadas peticiones. Puedes implementar lógica de reintento con retroceso exponencial para manejar estos casos de forma adecuada.

La ventana de contexto es de 100.000 tokens, lo que incluye tanto el prompt como la completación. La salida máxima por petición es de 32.000 tokens, o 2.048 si no se establece max_tokens. Esto permite aplicaciones de contexto largo, como análisis de documentos o conversaciones extendidas.

Límite estricto de contenido: Aunque el modelo es sin censura, siempre rechaza el contenido sexual que involucre a menores. Este es un límite estricto aplicado por el propio modelo.

Entender estos límites te ayuda a diseñar tu aplicación para manejar el límite de peticiones y gestionar el uso de tokens de manera eficiente. Para la mayoría de los casos de uso, estos límites son suficientes, pero las aplicaciones de alto rendimiento pueden necesitar implementar mecanismos de cola.

Privacidad y uso de datos

La privacidad es una consideración clave para muchos desarrolladores. Este servicio no utiliza tus prompts para entrenamiento. Tus datos se procesan para generar la respuesta y no se almacenan para la mejora a largo plazo del modelo. Esto asegura que los datos de entrada de tu aplicación permanezcan privados y no se utilicen para entrenar el modelo base.

Privacidad de la cuenta: Tu cuenta requiere únicamente una dirección de correo electrónico. No se necesita número de teléfono ni identificación personal. Esto reduce la cantidad de datos personales que compartes con el servicio.

Manejo de datos: Los prompts no se utilizan para entrenamiento. Esta es una ventaja significativa para las empresas que necesitan mantener la confidencialidad de sus datos propietarios o de las entradas de los usuarios. El servicio está diseñado para ser transparente sobre sus prácticas de datos.

Sin filtración de datos de entrenamiento: Dado que los prompts no se utilizan para el entrenamiento, no necesitas preocuparte por que tus datos aparezcan en las salidas futuras del modelo. Este es un diferenciador clave frente a algunos modelos gratuitos o compartidos que utilizan datos de usuarios para el entrenamiento.

Este enfoque centrado en la privacidad hace que la API sea adecuada para aplicaciones empresariales donde la confidencialidad de los datos es primordial. Puedes integrar el modelo sin censura con confianza, sabiendo que tus datos se respetan y no se reutilizan.

Preguntas y respuestas

¿En qué se basa el modelo de API de LLM sin censura?

El modelo es un modelo de pesos abiertos ejecutado en nuestros propios servidores, ajustado para responder sin denegaciones de contenido para uso adulto lícito. No es GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama ni ningún otro modelo de proveedor.

¿Cómo recargo mi cuenta?

Puedes recargar usando solo criptomonedas: USDT (TRC20) o USDC (Base). La cantidad mínima es $10 y la máxima es $500. Se otorgan créditos bonificados por recargas de $50 o más.

¿La API admite streaming?

Sí, la API admite streaming mediante Server-Sent Events (SSE). El uso de tokens se incluye en el último fragmento del stream, lo que te permite rastrear los costos con precisión.

¿Cuáles son los límites de peticiones?

Los límites son de 300 peticiones por minuto por clave, 8 peticiones simultáneas por clave y un tamaño máximo del cuerpo de la petición de 8 MB. Estos límites garantizan un uso justo y un rendimiento constante.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave y cambia la URL base. Eso es todo el proceso de configuración.