Como integrar a API Unrestricted AI para saídas sem censura
Integrar uma API de IA sem restrições permite que desenvolvedores contornem filtros de conteúdo nas saídas de LLM usando um endpoint de modelo de pesos abertos direto. Este guia cobre a configuração técnica, preços e restrições de implantação de uma API LLM sem censura para geração de texto bruto e sem filtros.
Pontos principais
- A API usa uma interface padrão compatível com OpenAI, exigindo apenas uma alteração na URL base e uma chave de API.
- O preço é baseado no uso: US$ 0,25 por milhão de tokens de entrada e US$ 1,00 por milhão de tokens de saída, sem mensalidades.
- Recargas de cripto via USDT ou USDC fornecem créditos bônus, enquanto créditos de teste estão disponíveis para novas contas.
- O modelo suporta streaming, chamada de funções e modo JSON, mas não oferece embeddings nem geração de imagens.
Por que usar uma API sem censura?
Provedores de LLM padrão frequentemente aplicam camadas de moderação de conteúdo que recusam prompts com base em critérios subjetivos, como tropos de ficção criativa, tópicos políticos ou temas adultos. Para desenvolvedores que criam aplicativos onde essas recusas quebram a experiência do usuário, uma API LLM sem censura oferece um caminho direto para as saídas do modelo sem essas barreiras artificiais. Este serviço hospeda um único modelo de pesos abertos ajustado para responder sem recusas de conteúdo para uso adulto legal, garantindo comportamento consistente em diversos tópicos.
Ao contrário de agregadores que roteiam requisições entre vários modelos de fornecedores, este serviço usa uma infraestrutura dedicada. Isso elimina a complexidade de gerenciar várias chaves de API e formatos de resposta variáveis. O modelo não é GPT, Claude, Gemini ou qualquer outro modelo de fornecedor; é um modelo distinto de pesos abertos executado em nossos servidores. Esta abordagem reduz a latência e garante que o comportamento 'sem censura' seja consistente, pois depende do ajuste do modelo base e não de uma camada de moderação dinâmica aplicada por um agregador de terceiros.
No entanto, esta não é uma solução universal. Se você precisar de embeddings, geração de imagens ou múltiplas opções de modelos, esta API apenas de texto pode não se adequar à sua stack. Ela foi projetada especificamente para desenvolvedores que precisam de saídas de texto bruto e querem evitar a sobrecarga de roteamento de modelos ou a imprevisibilidade de interfaces de chat web.
Compreendendo a Interface Compatível com OpenAI
A API segue o esquema padrão de chat-completions da OpenAI, tornando a integração direta para desenvolvedores já familiarizados com SDKs da OpenAI. Você interage com o endpoint usando métodos HTTP padrão, principalmente POST para completions e GET para informações de modelos. A URL base é https://api.unrestrictedai.cc/v1, e você pode usar qualquer cliente compatível com OpenAI atualizando o base_url e fornecendo sua chave de API.
O endpoint principal é POST /v1/chat/completions, que aceita um array de mensagens e retorna uma resposta de texto. Endpoints adicionais incluem GET /v1/models para listar modelos disponíveis. Não há endpoints de embeddings, áudio, vídeo ou fine-tuning. Essa simplicidade reduz a curva de aprendizado e permite que você substitua o modelo sem censura com alterações mínimas de código.
- Método: POST para completions, GET para informações do modelo.
- Formato: Corpo de solicitação JSON com array de mensagens.
- Resposta: Objeto JSON contendo o texto gerado.
- Compatibilidade: Funciona com SDKs oficiais da OpenAI e clientes de terceiros como LangChain ou LlamaIndex.
Esta interface garante que sua base de código existente possa aproveitar os recursos sem censura sem uma reescrita completa. Você controla os parâmetros, como temperature e top_p, para ajustar a criatividade e o determinismo das saídas.
Configurando sua Chave de API Unrestricted AI
Começar requer uma conta, que pode ser criada via 'Continuar com Google' ou registrando-se com um e-mail e senha. Nenhum número de telefone é necessário, e o processo é projetado para velocidade. Ao se registrar, você é direcionado para a página 'Obter chave de API', onde sua chave de API é exibida imediatamente. Esta chave é usada para autenticar todas as requisições à API.
Cada conta é limitada a uma chave ativa. Se você gerar uma nova chave, a anterior é invalidada. Isso simplifica o gerenciamento de segurança, pois você não precisa rastrear várias chaves para uma única conta. A chave concede acesso ao modelo sem censura e é cobrada com base no uso real de tokens.
Créditos de teste: Cada nova conta recebe US$ 0,50 de crédito de teste, válido por 7 dias. Não é necessário cartão de crédito para resgatar este crédito, facilitando o teste da API antes de decidir pela compra. O teste é único por pessoa e não pode ser combinado com outras ofertas.
Privacidade: Sua conta requer apenas um endereço de e-mail. Os prompts enviados para a API não são usados para treinamento, garantindo que seus dados permaneçam privados. Este é um recurso-chave para desenvolvedores que precisam manter a confidencialidade dos dados de entrada de seus aplicativos.
Fazendo sua Primeira Requisição
Com sua chave de API e URL base prontas, você pode fazer sua primeira requisição. A API aceita formatos de mensagem padrão, incluindo funções system, user e assistant. Aqui está um exemplo usando cURL:
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Esta requisição envia um prompt simples para o modelo. A resposta conterá o texto gerado, junto com estatísticas de uso de tokens. O model id a ser enviado é 'uncensored'. Este identificador é usado no corpo da requisição para especificar o modelo.
Você também pode usar o SDK oficial da OpenAI em Python. Inicialize o cliente com sua URL base e chave de API, depois chame o método chat.completions.create. A estrutura da resposta corresponde ao formato da OpenAI, incluindo choices, finish_reason e estatísticas de uso.
Parâmetros-Chave:
- model: 'uncensored'
- messages: Array de objetos de mensagem
- temperature: Controla aleatoriedade (padrão 1.0)
- max_tokens: Máximo de tokens de saída (padrão 2048)
Esta configuração permite que você integre rapidamente o modelo sem censura ao seu aplicativo. O tempo de resposta é geralmente baixo, refletindo a infraestrutura direta sem sobrecarga de roteamento.
Lidando com Streaming e Ferramentas
A API suporta streaming via Server-Sent Events (SSE), essencial para experiências de usuário em tempo real. Quando o streaming está habilitado, a API envia respostas parciais conforme são geradas. O último chunk contém o uso total de tokens, permitindo que você rastreie os custos com precisão. Isso é útil para interfaces de chat que exibem texto conforme é gerado.
A chamada de funções (ferramentas) também é suportada. Você pode definir ferramentas em sua requisição, e o modelo retornará uma saída JSON estruturada que pode ser analisada e executada pelo seu aplicativo. Isso permite fluxos de trabalho complexos, como interagir com APIs externas ou bancos de dados.
Modo JSON: Você pode forçar a saída JSON definindo response_format para json_object. Isso garante que o modelo retorne JSON válido, o que é crítico para consumo programático.
Outros Parâmetros:
- stop: Sequências em que a API deixará de gerar tokens adicionais.
- seed: Para saídas reproduzíveis.
- presence_penalty: Incentiva o modelo a falar sobre novos tópicos.
- frequency_penalty: Penaliza novos tokens com base em sua frequência existente no texto.
Esses recursos tornam a API adequada para uma ampla gama de aplicativos, desde chatbots simples até sistemas baseados em agentes complexos.
Preços e Pagamentos com Criptomoedas
O modelo de preços é direto e baseado no uso. Não há mensalidades ou assinaturas. Você paga pelo que usa:
- Tokens de entrada: $0,25 por 1M tokens
- Tokens de saída: $1,00 por 1M tokens
Erros e recusas são gratuitos, o que significa que você não paga por tokens que não foram gerados com sucesso. O crédito é pré-pago e nunca expira, então você pode recarregar conforme necessário. Este modelo é transparente e previsível, permitindo que você estime os custos com base no uso esperado de tokens.
Processo de recarga: Os pagamentos são aceitos apenas via criptomoeda. Você pode recarregar usando USDT (TRC20) ou USDC (Base). O valor mínimo de recarga é US$ 10 e o máximo é US$ 500. Créditos bônus são concedidos para recargas maiores:
- Recarga de US$ 50: +5% de crédito bônus
- Recarga de US$ 100: +10% de crédito bônus
Reembolsos não são emitidos para saldos de crédito, mas erros como cobranças duplicadas podem ser resolvidos pela página de Suporte. Este modelo apenas com criptomoedas reduz as taxas de transação e simplifica os pagamentos globais.
Limites de Requisição e Cotas
Para garantir o uso justo e manter o desempenho, a API impõe os seguintes limites por chave de API:
- Requisições por minuto: 300
- Requisições simultâneas: 8
- Tamanho máximo do corpo da requisição: 8 MB
Esses limites são aplicados para evitar abuso e garantir latência consistente. Se você exceder o limite de requisições, receberá um erro 429 Too Many Requests. Você pode implementar lógica de nova tentativa com backoff exponencial para lidar com esses casos de forma elegante.
A janela de contexto é de 100.000 tokens, o que inclui tanto o prompt quanto a conclusão. A saída máxima por requisição é de 32.000 tokens, ou 2.048 se max_tokens não estiver definido. Isso permite aplicações de contexto longo, como análise de documentos ou conversas extensas.
Limite rígido de conteúdo: Embora o modelo seja sem censura, ele sempre recusa conteúdo sexual envolvendo menores. Este é um limite rígido aplicado pelo próprio modelo.
Entender esses limites ajuda você a projetar sua aplicação para lidar com o limite de requisições e gerenciar o uso de tokens de forma eficiente. Para a maioria dos casos de uso, esses limites são suficientes, mas aplicações de alta vazão podem precisar implementar mecanismos de fila.
Privacidade e Uso de Dados
A privacidade é uma consideração-chave para muitos desenvolvedores. Este serviço não usa seus prompts para treinamento. Seus dados são processados para gerar a resposta e não são armazenados para melhoria de longo prazo do modelo. Isso garante que os dados de entrada da sua aplicação permaneçam privados e não sejam usados para treinar o modelo base.
Privacidade da conta: Sua conta requer apenas um endereço de e-mail. Nenhum número de telefone ou identificação pessoal é necessário. Isso reduz a quantidade de dados pessoais que você compartilha com o serviço.
Tratamento de dados: Os prompts não são usados para treinamento. Esta é uma vantagem significativa para empresas que precisam manter a confidencialidade de seus dados proprietários ou entradas de usuários. O serviço é projetado para ser transparente sobre suas práticas de dados.
Sem vazamento de dados de treinamento: Como os prompts não são usados para treinamento, você não precisa se preocupar com seus dados aparecendo nas saídas futuras do modelo. Este é um diferencial-chave em relação a alguns modelos gratuitos ou compartilhados que usam dados de usuários para treinamento.
Essa abordagem centrada na privacidade torna a API adequada para aplicações empresariais onde a confidencialidade dos dados é primordial. Você pode integrar o modelo sem censura com confiança, sabendo que seus dados são respeitados e não reaproveitados.
Perguntas e respostas
Em qual modelo de api llm sem censura se baseia?
O modelo é um modelo de pesos abertos executado em nossos próprios servidores, ajustado para responder sem recusas de conteúdo para uso adulto lícito. Não é GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama ou qualquer outro modelo de fornecedor.
Como faço para recarregar minha conta?
Você pode recarregar apenas com criptomoeda: USDT (TRC20) ou USDC (Base). O valor mínimo é $10 e o máximo é $500. Créditos bônus são concedidos para recargas de $50 ou mais.
A API suporta streaming?
Sim, a API suporta streaming via Server-Sent Events (SSE). O uso de tokens é incluído no último pacote do fluxo, permitindo que você acompanhe os custos com precisão.
Quais são os limites de requisição?
Os limites são 300 requisições por minuto por chave, 8 requisições simultâneas por chave e um tamanho máximo do corpo da requisição de 8 MB. Esses limites garantem o uso justo e o desempenho consistente.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.