FR ▾
Obtenir une clé API

Guide de démarrage rapide de l'API Unrestricted AI

Intégrez l'API Unrestricted AI avec une seule URL de base et des SDK compatibles OpenAI. Obtenez des sorties de modèle brutes et sans censure sans refus de contenu ni surcharge de routage de modèle.

base_url
https://api.unrestrictedai.cc/v1
Modèle
sans censure

Authentification et URL de base

L'API Unrestricted AI utilise l'authentification standard par jeton porteur. Vous obtenez votre clé API immédiatement après vous être connecté avec Google ou une adresse e-mail sur la page Obtenir la clé API. Aucun numéro de téléphone n'est requis. Utilisez l'URL de base https://api.unrestrictedai.cc/v1 pour toutes les requêtes. Cette URL fonctionne avec les SDK officiels OpenAI et tout client compatible OpenAI en mettant simplement à jour la configuration base_url. Votre clé donne accès au modèle sans censure identifié par l'ID uncensored. Il s'agit d'un modèle à poids ouverts unique, exécuté sur nos propres serveurs, et non de GPT, Claude ou tout autre modèle d'un autre fournisseur. Nous n'effectuons pas de routage de modèle, garantissant un accès à faible latence à un modèle optimisé pour le contenu adulte et sans filtre, sans la surcharge d'une interface de chat web. La clé API est unique par compte ; la génération d'une nouvelle clé remplace la précédente.

Requête de chat basique

Envoyez une requête POST vers /v1/chat/completions avec vos messages et l'ID du modèle. L'exemple suivant illustre une interaction standard texte en entrée, texte en sortie à l'aide de l'outil en ligne de commande cURL. Remplacez YOUR_API_KEY par votre clé réelle. L'ID du modèle doit être défini sur uncensored. Cet endpoint renvoie la réponse du modèle sous forme de JSON. Assurez-vous de parser le corps de la réponse pour extraire le contenu du message de l'assistant. Cette requête de base constitue le fondement pour créer des applications nécessitant des réponses LLM brutes et sans filtre, sans refus de contenu ni surcharge de routage de modèle.

Intégration SDK Python

L'utilisation du SDK Python officiel simplifie l'intégration avec l'API sans censure. Configurez le client avec l'URL de base correcte et votre clé API. Le code ci-dessous montre comment instancier le client et envoyer une requête à l'API LLM sans censure. Cette approche est idéale pour les services backend ou les scripts où vous avez besoin d'un contrôle programmatique des paramètres de requête. Le SDK gère automatiquement la sérialisation JSON et les connexions HTTP. N'oubliez pas que l'ID du modèle reste uncensored. Cette méthode est efficace pour les développeurs qui préfèrent les interfaces typées et la gestion robuste des erreurs dans leurs applications Python.

Utilisation SDK Node.js

Pour les environnements JavaScript et TypeScript, le SDK Node fournit un moyen natif d'interagir avec l'API. Définissez baseURL sur notre endpoint et fournissez votre clé API. L'extrait suivant illustre une requête de complétion simple. Ce modèle est adapté au rendu côté serveur ou aux passerelles API. La structure de la réponse correspond au format OpenAI, ce qui facilite la migration du code OpenAI existant. Assurez-vous de gérer correctement les réponses asynchrones. La clé API de l'IA sans censure vous permet de passer d'OpenAI à notre service avec des modifications de code minimales, en préservant la logique de votre application existante tout en accédant à un contenu sans filtre.

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. L'API renvoie un flux d'événements envoyés par le serveur (SSE) de réponses partielles. Cela est utile pour les interfaces utilisateur en temps réel où vous souhaitez afficher les tokens au fur et à mesure de leur génération. Le dernier fragment du flux contient les statistiques d'utilisation des tokens. Le streaming vous permet de commencer à afficher du contenu à l'utilisateur avant que la réponse complète ne soit prête, améliorant la latence perçue. Assurez-vous que votre client parse correctement le format SSE. Cette fonctionnalité est disponible pour toutes les requêtes à l'API AI sans censure, vous permettant de créer des applications réactives qui gèrent les réponses LLM brutes et sans filtre sans refus de contenu ni surcharge de routage de modèle.

Paramètres, limites et erreurs

La fenêtre de contexte fait 100 000 tokens au total, avec une sortie maximale de 32 000 tokens par requête. Si max_tokens n'est pas défini, la limite est de 2 048 tokens. Vous pouvez utiliser des paramètres comme temperature, top_p, stop et seed pour contrôler la génération. Les limites de débit sont de 300 requêtes par minute et 8 requêtes simultanées par clé. Les corps de requête doivent faire moins de 8 Mo. Les erreurs courantes incluent 401 (clé invalide), 402 (crédit insuffisant) et 429 (limite de débit). Le crédit est prépayé et n'expire jamais. Les erreurs et les refus sont gratuits. La seule limite stricte de contenu concerne le contenu sexuel impliquant des mineurs, qui est toujours refusé. Aucune carte n'est nécessaire pour l'essai de 0,50 $ valable 7 jours.

cURL

curl https://api.unrestrictedai.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestrictedai.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestrictedai.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Caractéristiques techniques

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.unrestrictedai.cc/v1
EndpointsPOST /v1/chat/completions · GET /v1/models
ID du modèleuncensored
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Mode JSONresponse_format: {"type": "json_object"}
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Fenêtre de contexte100 000 tokens (entrée + sortie)
Concurrence8 requêtes simultanées par clé
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Limite de débit300 requêtes par minute et par clé
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Bonus+5 % dès 50 $, +10 % dès 100 $
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Validitéle crédit payé n'expire jamais, sans abonnement
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Codes d'erreur

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Est-ce que cette API est un service officiel OpenAI ?

Non. Nous proposons un seul modèle à poids ouverts sans censure via une interface standard compatible OpenAI. Ce n'est pas GPT, Claude, Gemini ou le modèle d'un autre fournisseur. Il s'agit d'un service indépendant fonctionnant sur nos propres serveurs.

Comment recharger mon crédit ?

Le crédit est rechargé uniquement en crypto : USDT (TRC20) ou USDC (Base). Le rechargement minimum est de 10 $, le maximum de 500 $. Vous bénéficiez d'un bonus de +5 % pour les rechargements de 50 $ et de +10 % pour 100 $. Les cartes et PayPal ne sont pas acceptés.

Quelle est la taille de la fenêtre de contexte ?

La fenêtre de contexte est de 100 000 tokens pour le prompt et la complétion combinés. La sortie maximale par requête est de 32 000 tokens, ou 2 048 tokens si max_tokens n'est pas spécifié.

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.