Unrestricted AI API-Schnellstart-Leitfaden
Integriere die Unrestricted AI-API mit einer einzigen Basis-URL und standardmäßigen OpenAI-kompatiblen SDKs. Erhalte rohe Ausgaben des unzensierten Modells ohne Inhaltsfilterung oder Overhead durch Modell-Routing.
- base_url
- https://api.unrestrictedai.cc/v1
- Modell
- unzensiert
Authentifizierung und Basis-URL
Die Unrestricted AI-API verwendet die Standard-Authentifizierung mit Bearer-Token. Du erhältst deinen API-Schlüssel sofort nach der Anmeldung mit Google oder einer E-Mail-Adresse auf der Seite API-Schlüssel erhalten. Es wird keine Telefonnummer benötigt. Verwende die Base URL https://api.unrestrictedai.cc/v1 für alle Anfragen. Diese URL funktioniert mit den offiziellen OpenAI-SDKs und jedem OpenAI-kompatiblen Client, indem du einfach die Konfiguration base_url aktualisierst. Dein Schlüssel gewährt Zugriff auf das unzensierte Modell mit der ID uncensored. Dies ist ein einzelnes Open-Weight-Modell, das auf unseren eigenen Servern läuft, nicht GPT, Claude oder das Modell eines anderen Anbieters. Wir führen kein Model Routing durch, was direkten Zugriff auf ein Modell garantiert, das für erwachsene und unzensierte Inhalte optimiert ist, ohne den Ballast einer Web-Chat-Benutzeroberfläche. Der API-Schlüssel ist pro Konto eindeutig; das Generieren eines neuen Schlüssels ersetzt den vorherigen.
Einfache Chat-Anfrage
Sende eine POST-Anfrage an /v1/chat/completions mit deinen Nachrichten und der Modell-ID. Das folgende Beispiel zeigt eine Standard-Text-zu-Text-Interaktion mit dem cURL-Befehlszeilentool. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Modell-ID muss auf uncensored gesetzt sein. Dieser Endpunkt gibt die Antwort des Modells als JSON zurück. Stelle sicher, dass du den Antworttext verarbeitest, um den Inhalt der Assistentennachricht zu extrahieren. Diese einfache Anfrage ist die Grundlage für den Aufbau von Anwendungen, die rohe, unzensierte LLM-Antworten ohne Inhaltsfilterung oder Modell-Routing-Overhead erfordern.
Python SDK-Integration
Die Verwendung des offiziellen Python SDK vereinfacht die Integration mit der unzensierten API. Konfiguriere den Client mit der korrekten Base URL und deinem API-Schlüssel. Der folgende Code zeigt, wie du den Client instanzierst und eine Anfrage an die unzensierte LLM-API sendest. Dieser Ansatz ist ideal für Backend-Dienste oder Skripte, bei denen du programmgesteuerte Kontrolle über die Anfrageparameter benötigst. Das SDK übernimmt die JSON-Serialisierung und HTTP-Verbindungen automatisch. Denke daran, dass die Modell-ID weiterhin uncensored lautet. Diese Methode ist effizient für Entwickler, die typisierte Schnittstellen und robuste Fehlerbehandlung in ihren Python-Anwendungen bevorzugen.
Node.js SDK-Nutzung
Für JavaScript- und TypeScript-Umgebungen bietet das Node SDK eine native Möglichkeit zur Interaktion mit der API. Setze die baseURL auf unseren Endpunkt und gib deinen API-Schlüssel an. Das folgende Snippet zeigt eine einfache Completion-Anfrage. Dieses Muster eignet sich für Server-Side-Rendering oder API-Gateways. Die Antwortstruktur entspricht dem OpenAI-Format, was die Migration bestehenden OpenAI-Codes erleichtert. Stelle sicher, dass du asynchrone Antworten korrekt behandelst. Der API-Schlüssel für die unzensierte KI ermöglicht es dir, mit minimalem Codeaufwand von OpenAI zu unserem Service zu wechseln und behält dabei deine bestehende Anwendungslogik bei, während du Zugriff auf unzensierte Inhalte erhältst.
Streaming-Antworten
Aktiviere das Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream von Teilantworten zurück. Dies ist nützlich für Echtzeit-Benutzeroberflächen, in denen du Token anzeigen möchtest, sobald sie generiert werden. Der letzte Chunk des Streams enthält die Token-Nutzungsstatistiken. Streaming ermöglicht es dir, Inhalte für den Benutzer anzuzeigen, bevor die vollständige Antwort bereit ist, was die wahrgenommene Latenz verbessert. Stelle sicher, dass dein Client das SSE-Format korrekt parst. Diese Funktion ist für alle Anfragen an die unzensierte KI-API verfügbar, sodass du reaktionsfähige Anwendungen erstellen kannst, die rohe, unzensierte LLM-Antworten ohne Inhaltsfilterung oder Overhead durch Modell-Routing verarbeiten.
Parameter, Limits und Fehler
Das Kontextfenster umfasst insgesamt 100.000 Token, mit einem maximalen Output von 32.000 Token pro Anfrage. Wenn max_tokens nicht festgelegt ist, beträgt die Grenze 2.048 Token. Du kannst Parameter wie temperature, top_p, stop und seed verwenden, um die Generierung zu steuern. Die Ratenlimits liegen bei 300 Anfragen pro Minute und 8 parallelen Anfragen pro Schlüssel. Anforderungstexte müssen unter 8 MB liegen. Häufige Fehler sind 401 (ungültiger Schlüssel), 402 (unzureichendes Guthaben) und 429 (Ratenlimit). Guthaben ist Prepaid-Guthaben und verfällt nie. Fehler und Refusals sind kostenlos. Die einzige harte Inhaltsgrenze ist sexueller Inhalt, der Minderjährige betrifft, der immer abgelehnt wird. Für das 7 Tage gültige Testguthaben in Höhe von $0,50 wird keine Karte benötigt.
cURL
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Python
from openai import OpenAI
client = OpenAI(base_url="https://api.unrestrictedai.cc/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Node.js
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unrestrictedai.cc/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Streaming
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Technische Daten
Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Base-URL | https://api.unrestrictedai.cc/v1 |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Modell-ID | uncensored |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Ist diese API ein offizieller OpenAI-Dienst?
Nein. Wir bieten ein einzelnes, unzensiertes Open-Weight-Modell über eine standardmäßige OpenAI-kompatible Schnittstelle an. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Es ist ein unabhängiger Dienst, der auf unseren eigenen Servern läuft.
Wie lade ich mein Guthaben auf?
Guthaben wird nur per Kryptowährung aufgeladen: USDT (TRC20) oder USDC (Base). Mindestaufladung: 10 USD, maximal 500 USD. Du erhältst einen Bonus von +5 % bei Aufladungen von 50 USD und +10 % bei 100 USD. Keine Karten oder PayPal.
Wie groß ist das Kontextfenster?
Das Kontextfenster umfasst 100.000 Token für Prompt und Completion zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token bzw. 2.048 Token, wenn max_tokens nicht festgelegt ist.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.