DE ▾
API-Schlüssel erhalten

Unrestricted AI API-Schnellstart-Leitfaden

Integriere die Unrestricted AI-API mit einer einzigen Basis-URL und standardmäßigen OpenAI-kompatiblen SDKs. Erhalte rohe Ausgaben des unzensierten Modells ohne Inhaltsfilterung oder Overhead durch Modell-Routing.

base_url
https://api.unrestrictedai.cc/v1
Modell
unzensiert

Authentifizierung und Basis-URL

Die Unrestricted AI-API verwendet die Standard-Authentifizierung mit Bearer-Token. Du erhältst deinen API-Schlüssel sofort nach der Anmeldung mit Google oder einer E-Mail-Adresse auf der Seite API-Schlüssel erhalten. Es wird keine Telefonnummer benötigt. Verwende die Base URL https://api.unrestrictedai.cc/v1 für alle Anfragen. Diese URL funktioniert mit den offiziellen OpenAI-SDKs und jedem OpenAI-kompatiblen Client, indem du einfach die Konfiguration base_url aktualisierst. Dein Schlüssel gewährt Zugriff auf das unzensierte Modell mit der ID uncensored. Dies ist ein einzelnes Open-Weight-Modell, das auf unseren eigenen Servern läuft, nicht GPT, Claude oder das Modell eines anderen Anbieters. Wir führen kein Model Routing durch, was direkten Zugriff auf ein Modell garantiert, das für erwachsene und unzensierte Inhalte optimiert ist, ohne den Ballast einer Web-Chat-Benutzeroberfläche. Der API-Schlüssel ist pro Konto eindeutig; das Generieren eines neuen Schlüssels ersetzt den vorherigen.

Einfache Chat-Anfrage

Sende eine POST-Anfrage an /v1/chat/completions mit deinen Nachrichten und der Modell-ID. Das folgende Beispiel zeigt eine Standard-Text-zu-Text-Interaktion mit dem cURL-Befehlszeilentool. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel. Die Modell-ID muss auf uncensored gesetzt sein. Dieser Endpunkt gibt die Antwort des Modells als JSON zurück. Stelle sicher, dass du den Antworttext verarbeitest, um den Inhalt der Assistentennachricht zu extrahieren. Diese einfache Anfrage ist die Grundlage für den Aufbau von Anwendungen, die rohe, unzensierte LLM-Antworten ohne Inhaltsfilterung oder Modell-Routing-Overhead erfordern.

Python SDK-Integration

Die Verwendung des offiziellen Python SDK vereinfacht die Integration mit der unzensierten API. Konfiguriere den Client mit der korrekten Base URL und deinem API-Schlüssel. Der folgende Code zeigt, wie du den Client instanzierst und eine Anfrage an die unzensierte LLM-API sendest. Dieser Ansatz ist ideal für Backend-Dienste oder Skripte, bei denen du programmgesteuerte Kontrolle über die Anfrageparameter benötigst. Das SDK übernimmt die JSON-Serialisierung und HTTP-Verbindungen automatisch. Denke daran, dass die Modell-ID weiterhin uncensored lautet. Diese Methode ist effizient für Entwickler, die typisierte Schnittstellen und robuste Fehlerbehandlung in ihren Python-Anwendungen bevorzugen.

Node.js SDK-Nutzung

Für JavaScript- und TypeScript-Umgebungen bietet das Node SDK eine native Möglichkeit zur Interaktion mit der API. Setze die baseURL auf unseren Endpunkt und gib deinen API-Schlüssel an. Das folgende Snippet zeigt eine einfache Completion-Anfrage. Dieses Muster eignet sich für Server-Side-Rendering oder API-Gateways. Die Antwortstruktur entspricht dem OpenAI-Format, was die Migration bestehenden OpenAI-Codes erleichtert. Stelle sicher, dass du asynchrone Antworten korrekt behandelst. Der API-Schlüssel für die unzensierte KI ermöglicht es dir, mit minimalem Codeaufwand von OpenAI zu unserem Service zu wechseln und behält dabei deine bestehende Anwendungslogik bei, während du Zugriff auf unzensierte Inhalte erhältst.

Streaming-Antworten

Aktiviere das Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt einen Server-Sent Events (SSE)-Stream von Teilantworten zurück. Dies ist nützlich für Echtzeit-Benutzeroberflächen, in denen du Token anzeigen möchtest, sobald sie generiert werden. Der letzte Chunk des Streams enthält die Token-Nutzungsstatistiken. Streaming ermöglicht es dir, Inhalte für den Benutzer anzuzeigen, bevor die vollständige Antwort bereit ist, was die wahrgenommene Latenz verbessert. Stelle sicher, dass dein Client das SSE-Format korrekt parst. Diese Funktion ist für alle Anfragen an die unzensierte KI-API verfügbar, sodass du reaktionsfähige Anwendungen erstellen kannst, die rohe, unzensierte LLM-Antworten ohne Inhaltsfilterung oder Overhead durch Modell-Routing verarbeiten.

Parameter, Limits und Fehler

Das Kontextfenster umfasst insgesamt 100.000 Token, mit einem maximalen Output von 32.000 Token pro Anfrage. Wenn max_tokens nicht festgelegt ist, beträgt die Grenze 2.048 Token. Du kannst Parameter wie temperature, top_p, stop und seed verwenden, um die Generierung zu steuern. Die Ratenlimits liegen bei 300 Anfragen pro Minute und 8 parallelen Anfragen pro Schlüssel. Anforderungstexte müssen unter 8 MB liegen. Häufige Fehler sind 401 (ungültiger Schlüssel), 402 (unzureichendes Guthaben) und 429 (Ratenlimit). Guthaben ist Prepaid-Guthaben und verfällt nie. Fehler und Refusals sind kostenlos. Die einzige harte Inhaltsgrenze ist sexueller Inhalt, der Minderjährige betrifft, der immer abgelehnt wird. Für das 7 Tage gültige Testguthaben in Höhe von $0,50 wird keine Karte benötigt.

cURL

curl https://api.unrestrictedai.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Python

from openai import OpenAI

client = OpenAI(base_url="https://api.unrestrictedai.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Node.js

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unrestrictedai.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Streaming

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Technische Daten

Alle echten Grenzen und Funktionen der API auf einen Blick – prüfe sie, bevor du Guthaben kaufst.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Base-URLhttps://api.unrestrictedai.cc/v1
EndpunktePOST /v1/chat/completions · GET /v1/models
Modell-IDuncensored
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Ratenlimit300 Anfragen pro Minute und Schlüssel
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt

Fehlercodes

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Ist diese API ein offizieller OpenAI-Dienst?

Nein. Wir bieten ein einzelnes, unzensiertes Open-Weight-Modell über eine standardmäßige OpenAI-kompatible Schnittstelle an. Es ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters. Es ist ein unabhängiger Dienst, der auf unseren eigenen Servern läuft.

Wie lade ich mein Guthaben auf?

Guthaben wird nur per Kryptowährung aufgeladen: USDT (TRC20) oder USDC (Base). Mindestaufladung: 10 USD, maximal 500 USD. Du erhältst einen Bonus von +5 % bei Aufladungen von 50 USD und +10 % bei 100 USD. Keine Karten oder PayPal.

Wie groß ist das Kontextfenster?

Das Kontextfenster umfasst 100.000 Token für Prompt und Completion zusammen. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token bzw. 2.048 Token, wenn max_tokens nicht festgelegt ist.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.