IT ▾
Ottieni la chiave API

Come integrare un'API Unrestricted AI per output senza censura

L'integrazione di un'API AI senza restrizioni consente agli sviluppatori di bypassare i filtri sui contenuti nei risultati dei modelli linguistici utilizzando un endpoint di modello a pesi aperti diretto. Questa guida copre la configurazione tecnica, i prezzi e i vincoli del deployment di un'API LLM senza censura per la generazione di testo grezzo e senza filtri.

Aggiornato

Punti chiave

Perché usare un'API senza censura?

I fornitori LLM standard applicano spesso livelli di moderazione dei contenuti che rifiutano i prompt in base a criteri soggettivi, come tropi di scrittura creativa, argomenti politici o temi per adulti. Per gli sviluppatori che creano applicazioni in cui questi rifiuti interrompono l'esperienza utente, un'API LLM senza censura fornisce un percorso diretto agli output del modello senza queste barriere artificiali. Questo servizio ospita un singolo modello a pesi aperti ottimizzato per rispondere senza rifiuti di contenuti per uso adulto legale, garantendo un comportamento coerente su argomenti diversi.

A differenza degli aggregatori che instradano le richieste tra modelli di fornitori multipli, questo servizio utilizza un'infrastruttura dedicata. Questo elimina la complessità della gestione di più chiavi API e formati di risposta variabili. Il modello non è GPT, Claude, Gemini o il modello di alcun altro fornitore; è un modello a pesi aperti distinto in esecuzione sui nostri server. Questo approccio riduce la latenza e garantisce che il comportamento 'senza censura' sia coerente, poiché dipende dall'ottimizzazione del modello di base piuttosto che da un livello di moderazione dinamico applicato da un aggregatore di terze parti.

Tuttavia, questa non è una soluzione universale. Se richiedi embeddings, generazione di immagini o più scelte di modelli, questa API solo testo potrebbe non adattarsi al tuo stack. È progettata specificamente per gli sviluppatori che necessitano di output di testo grezzo e vogliono evitare il sovraccarico del routing dei modelli o l'imprevedibilità delle UI di chat web.

Comprendere l'interfaccia compatibile con OpenAI

L'API segue lo schema standard chat-completions di OpenAI, rendendo l'integrazione semplice per gli sviluppatori già familiari con gli SDK OpenAI. Interagisci con l'endpoint utilizzando metodi HTTP standard, principalmente POST per le completazioni e GET per le informazioni sul modello. L'URL di base è https://api.unrestrictedai.cc/v1, e puoi utilizzare qualsiasi client compatibile con OpenAI aggiornando il base_url e fornendo la tua chiave API.

L'endpoint principale è POST /v1/chat/completions, che accetta un array di messaggi e restituisce una risposta testuale. Gli endpoint aggiuntivi includono GET /v1/models per l'elenco dei modelli disponibili. Non ci sono endpoint per embeddings, audio, video o fine-tuning. Questa semplicità riduce la curva di apprendimento e ti permette di sostituire il modello senza censura con modifiche minime al codice.

  • Metodo: POST per le completazioni, GET per le informazioni sul modello.
  • Formato: Corpo della richiesta JSON con array di messaggi.
  • Risposta: Oggetto JSON contenente il testo generato.
  • Compatibilità: Funziona con gli SDK ufficiali OpenAI e client di terze parti come LangChain o LlamaIndex.

Questa interfaccia garantisce che il tuo codice esistente possa sfruttare le capacità senza censura senza una riscrittura completa. Controlli i parametri, come temperature e top_p, per regolare la creatività e il determinismo degli output.

Configurazione della tua chiave API Unrestricted AI

Per iniziare è necessario un account, che può essere creato tramite 'Continua con Google' o registrandosi con email e password. Non è richiesto il numero di telefono e il processo è progettato per la velocità. Dopo la registrazione, vieni reindirizzato alla pagina 'Ottieni chiave API', dove la tua chiave API viene visualizzata immediatamente. Questa chiave viene utilizzata per autenticare tutte le richieste all'API.

Ogni account è limitato a una chiave attiva. Se generi una nuova chiave, quella precedente viene invalidata. Questo semplifica la gestione della sicurezza, poiché non è necessario tenere traccia di più chiavi per un singolo account. La chiave concede l'accesso al modello senza censura e viene addebitata in base all'utilizzo reale dei token.

Crediti di prova: Ogni nuovo account riceve $0,50 di credito di prova, valido per 7 giorni. Non è necessaria una carta di credito per richiedere questa prova, rendendo facile testare l'API prima di impegnarsi in un acquisto. La prova è una per persona e non può essere combinata con altre offerte.

Privacy: Il tuo account richiede solo un indirizzo email. I prompt inviati all'API non vengono utilizzati per l'addestramento, garantendo che i tuoi dati rimangano privati. Questa è una caratteristica chiave per gli sviluppatori che devono mantenere la riservatezza dei dati di input della loro applicazione.

Eseguire la tua prima richiesta

Con la tua chiave API e l'URL di base pronti, puoi effettuare la tua prima richiesta. L'API accetta formati di messaggio standard, inclusi ruoli system, user e assistant. Ecco un esempio utilizzando cURL:


curl https://api.unrestrictedai.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Questa richiesta invia un prompt semplice al modello. La risposta conterrà il testo generato, insieme alle statistiche di utilizzo dei token. L'ID del modello da inviare è 'uncensored'. Questo identificatore viene utilizzato nel corpo della richiesta per specificare il modello.

Puoi anche utilizzare l'SDK Python ufficiale di OpenAI. Inizializza il client con il tuo URL di base e chiave API, quindi chiama il metodo chat.completions.create. La struttura della risposta corrisponde al formato OpenAI, incluse choices, finish_reason e statistiche di utilizzo.

Parametri chiave:

  • model: 'uncensored'
  • messages: Array di oggetti messaggio
  • temperature: Controlla la casualità (default 1.0)
  • max_tokens: Token di output massimi (default 2048)

Questa configurazione ti permette di integrare rapidamente il modello senza censura nella tua applicazione. Il tempo di risposta è generalmente basso, riflettendo l'infrastruttura diretta senza sovraccarico di routing.

Gestire streaming e strumenti

L'API supporta lo streaming tramite Server-Sent Events (SSE), essenziale per le esperienze utente in tempo reale. Quando lo streaming è abilitato, l'API invia risposte parziali man mano che vengono generate. L'ultimo chunk contiene l'utilizzo totale dei token, permettendoti di tracciare i costi con precisione. Questo è utile per le interfacce chat che visualizzano il testo man mano che viene generato.

La chiamata di funzioni (strumenti) è anche supportata. Puoi definire gli strumenti nella tua richiesta e il modello restituirà un output JSON strutturato che può essere analizzato ed eseguito dalla tua applicazione. Questo abilita flussi di lavoro complessi, come l'interazione con API esterne o database.

Modalità JSON: Puoi forzare l'output JSON impostando response_format su json_object. Questo garantisce che il modello restituisca JSON valido, fondamentale per il consumo programmatico.

Altri parametri:

  • stop: Sequenze in cui l'API smetterà di generare ulteriori token.
  • seed: Per output riproducibili.
  • presence_penalty: Incoraggia il modello a parlare di nuovi argomenti.
  • frequency_penalty: Penalizza i nuovi token in base alla loro frequenza esistente nel testo.

Queste funzionalità rendono l'API adatta a una vasta gamma di applicazioni, dai semplici chatbot ai sistemi basati su agenti complessi.

Prezzi e pagamenti con criptovalute

Il modello di prezzo è semplice e basato sull'utilizzo. Non ci sono canoni mensili o abbonamenti. Paghi solo ciò che usi:

  • Token in input: $0,25 per 1M token
  • Token in output: $1,00 per 1M token

Errori e rifiuti sono gratuiti, il che significa che non paghi i token che non vengono generati con successo. Il credito è prepagato e non scade mai, quindi puoi ricaricarlo quando necessario. Questo modello è trasparente e prevedibile, consentendoti di stimare i costi in base all'utilizzo previsto dei token.

Processo di ricarica: I pagamenti sono accettati esclusivamente tramite criptovalute. Puoi ricaricare utilizzando USDT (TRC20) o USDC (Base). L'importo minimo di ricarica è $10, il massimo è $500. Crediti bonus vengono assegnati per ricariche più grandi:

  • Ricarica di $50: +5% di credito bonus
  • Ricarica di $100: +10% di credito bonus

Non vengono emessi rimborsi per i saldi del credito, ma errori come addebiti doppi possono essere risolti tramite la pagina di supporto. Questo modello solo cripto riduce le commissioni di transazione e semplifica i pagamenti globali.

Limiti di richiesta e quote

Per garantire un utilizzo equo e mantenere le prestazioni, l'API applica i seguenti limiti per ogni chiave API:

  • Richieste al minuto: 300
  • Richieste concorrenti: 8
  • Dimensione massima del corpo della richiesta: 8 MB

Questi limiti sono applicati per prevenire abusi e garantire una latenza costante. Se superi il limite di richieste, riceverai un errore 429 Too Many Requests. Puoi implementare una logica di retry con backoff esponenziale per gestire questi casi in modo elegante.

La finestra di contesto è di 100.000 token, che includono sia il prompt che il completamento. L'output massimo per richiesta è di 32.000 token, o 2.048 se max_tokens non è impostato. Questo consente applicazioni a contesto lungo, come l'analisi di documenti o conversazioni estese.

Limite rigido sui contenuti: Sebbene il modello sia senza censura, rifiuta sempre i contenuti sessuali che coinvolgono minori. Si tratta di un limite rigido applicato direttamente dal modello.

Comprendere questi limiti ti aiuta a progettare la tua applicazione per gestire il limite di richieste e gestire l'utilizzo dei token in modo efficiente. Per la maggior parte dei casi d'uso, questi limiti sono sufficienti, ma le applicazioni ad alto throughput potrebbero dover implementare meccanismi di accodamento.

Privacy e utilizzo dei dati

La privacy è un aspetto fondamentale per molti sviluppatori. Questo servizio non utilizza i tuoi prompt per l'addestramento. I tuoi dati vengono elaborati per generare la risposta e non vengono memorizzati per il miglioramento a lungo termine del modello. Questo garantisce che i dati di input della tua applicazione rimangano privati e non vengano utilizzati per addestrare il modello di base.

Privacy dell'account: Il tuo account richiede solo un indirizzo email. Non è necessario un numero di telefono o un'identificazione personale. Questo riduce la quantità di dati personali che condividi con il servizio.

Gestione dei dati: I prompt non vengono utilizzati per l'addestramento. Questo è un vantaggio significativo per le aziende che devono mantenere la riservatezza dei loro dati proprietari o degli input degli utenti. Il servizio è progettato per essere trasparente sulle sue pratiche sui dati.

Nessuna perdita di dati di addestramento: Poiché i prompt non vengono utilizzati per l'addestramento, non devi preoccuparti che i tuoi dati appaiano negli output futuri del modello. Questo è un elemento distintivo chiave rispetto ad alcuni modelli gratuiti o condivisi che utilizzano i dati degli utenti per l'addestramento.

Questo approccio orientato alla privacy rende l'API adatta per applicazioni enterprise dove la riservatezza dei dati è fondamentale. Puoi integrare il modello senza censura con fiducia, sapendo che i tuoi dati sono rispettati e non riutilizzati.

Domande e risposte

Su cosa si basa il modello API LLM senza censura?

Il modello è un modello a pesi aperti eseguito sui nostri server, ottimizzato per rispondere senza rifiuti di contenuti per l'uso adulto legale. Non è GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama o alcun altro modello di un fornitore.

Come ricarico il mio account?

Puoi ricaricare utilizzando solo criptovalute: USDT (TRC20) o USDC (Base). L'importo minimo è di $10 e il massimo è di $500. Vengono assegnati crediti bonus per ricariche di $50 o più.

L'API supporta lo streaming?

Sì, l'API supporta lo streaming tramite Server-Sent Events (SSE). L'utilizzo dei token è incluso nell'ultimo chunk dello stream, consentendoti di tracciare i costi con precisione.

Quali sono i limiti di richiesta?

I limiti sono 300 richieste al minuto per chiave, 8 richieste concorrenti per chiave e una dimensione massima del corpo della richiesta di 8 MB. Questi limiti garantiscono un utilizzo equo e prestazioni costanti.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.