So integrierst du eine Unrestricted AI-API für unzensierte Ausgaben
Die Integration einer uneingeschränkten KI-API ermöglicht es Entwicklern, Inhaltsfilter in LLM-Ausgaben zu umgehen, indem ein direkter Endpunkt eines Open-Weight-Modells genutzt wird. Diese Anleitung behandelt die technische Einrichtung, die Preise und die Einschränkungen der Bereitstellung einer unzensierten LLM-API für rohe, unfilterierte Textgenerierung.
Wichtige Punkte
- Die API nutzt eine standardmäßige OpenAI-kompatible Schnittstelle und erfordert lediglich eine Änderung der Basis-URL und eines API-Schlüssels.
- Die Preise sind nutzungsbasiert: 0,25 $ pro Million Input-Token und 1,00 $ pro Million Output-Token, ohne monatliche Gebühren.
- Krypto-Aufladungen via USDT oder USDC bieten Bonusguthaben, während neue Konten kostenloses Testguthaben erhalten.
- Das Modell unterstützt Streaming, Function Calling und JSON-Modus, bietet jedoch keine Embeddings oder Bildgenerierung.
Warum eine unzensierte API nutzen?
Standard-LLM-Anbieter wenden häufig Moderationsschichten an, die Prompts basierend auf subjektiven Kriterien ablehnen, wie etwa kreative Schreibtropen, politische Themen oder erwachsene Themen. Für Entwickler, die Anwendungen erstellen, bei denen diese Ablehnungen die Benutzererfahrung beeinträchtigen, bietet eine unzensierte LLM-API einen direkten Weg zu Modellausgaben ohne diese künstlichen Barrieren. Dieser Dienst hostet ein einzelnes Open-Weight-Modell, das darauf abgestimmt ist, ohne Inhaltsablehnungen für die legale erwachsene Nutzung zu antworten, und sorgt so für ein konsistentes Verhalten über verschiedene Themen hinweg.
Im Gegensatz zu Aggregatoren, die Anfragen zwischen mehreren Anbietermodellen weiterleiten, nutzt dieser Dienst eine dedizierte Infrastruktur. Dies eliminiert die Komplexität der Verwaltung mehrerer API-Schlüssel und variierender Antwortformate. Das Modell ist kein GPT, Claude, Gemini oder ein Modell eines anderen Anbieters; es ist ein eigenständiges Open-Weight-Modell, das auf unseren Servern läuft. Dieser Ansatz reduziert die Latenz und stellt sicher, dass das Verhalten „unzensiert“ konsistent ist, da es auf der Abstimmung des Basismodells und nicht auf einer dynamischen Moderationsschicht eines Drittanbieter-Aggregators beruht.
Dies ist jedoch keine universelle Lösung. Wenn du Embeddings, Bildgenerierung oder mehrere Modellauswahlen benötigst, passt diese reine Text-API möglicherweise nicht zu deiner Stack-Architektur. Sie ist speziell für Entwickler konzipiert, die Rohtextausgaben benötigen und die Overheads des Model-Routings oder die Unvorhersehbarkeit von Web-Chat-Oberflächen vermeiden möchten.
Die OpenAI-kompatible Schnittstelle verstehen
Die API folgt dem Standard-OpenAI-Chat-Completions-Schema, was die Integration für Entwickler, die bereits mit OpenAI-SDKs vertraut sind, einfach macht. Du interagierst mit dem Endpunkt über standardmäßige HTTP-Methoden, hauptsächlich POST für Completions und GET für Modellinformationen. Die Basis-URL ist https://api.unrestrictedai.cc/v1, und du kannst jeden OpenAI-kompatiblen Client nutzen, indem du die base_url aktualisierst und deinen API-Schlüssel angibst.
Der Kernendpunkt ist POST /v1/chat/completions, der ein Nachrichtenarray akzeptiert und eine Textantwort zurückgibt. Zusätzliche Endpunkte umfassen GET /v1/models zum Auflisten verfügbarer Modelle. Es gibt keine Embedding-, Audio-, Video- oder Fine-Tuning-Endpunkte. Diese Einfachheit reduziert die Lernkurve und ermöglicht es dir, das unzensierte Modell mit minimalen Codeänderungen einzufügen.
- Methode: POST für Completions, GET für Modellinformationen.
- Format: JSON-Anfragekörper mit Nachrichtenarray.
- Antwort: JSON-Objekt, das den generierten Text enthält.
- Kompatibilität: Funktioniert mit offiziellen OpenAI-SDKs und Drittanbieter-Clients wie LangChain oder LlamaIndex.
Diese Schnittstelle stellt sicher, dass deine bestehende Codebasis die unzensierten Funktionen nutzen kann, ohne eine vollständige Neuimplementierung. Du steuerst die Parameter wie Temperatur und top_p, um die Kreativität und Determiniertheit der Ausgaben einzustellen.
Deinen Unrestricted AI-API-Schlüssel einrichten
Der Einstieg erfordert ein Konto, das über „Weiter mit Google“ erstellt oder durch Registrierung mit E-Mail und Passwort angelegt werden kann. Keine Telefonnummer ist erforderlich, und der Prozess ist auf Geschwindigkeit ausgelegt. Nach der Anmeldung wirst du zur Seite „API-Schlüssel erhalten“ weitergeleitet, wo dein API-Schlüssel sofort angezeigt wird. Dieser Schlüssel wird zur Authentifizierung aller Anfragen an die API verwendet.
Jedes Konto ist auf einen aktiven Schlüssel beschränkt. Wenn du einen neuen Schlüssel generierst, wird der vorherige ungültig. Dies vereinfacht das Sicherheitsmanagement, da du nicht mehrere Schlüssel für ein einzelnes Konto verfolgen musst. Der Schlüssel gewährt Zugriff auf das unzensierte Modell und wird basierend auf der tatsächlichen Token-Nutzung abgerechnet.
Testguthaben: Jedes neue Konto erhält 0,50 $ an Testguthaben, das 7 Tage gültig ist. Keine Kreditkarte ist erforderlich, um dieses Testguthaben zu beanspruchen, was das Testen der API vor dem Kauf einfach macht. Das Testguthaben ist pro Person einmalig und kann nicht mit anderen Angeboten kombiniert werden.
Datenschutz: Dein Konto erfordert nur eine E-Mail-Adresse. An die API gesendete Prompts werden nicht zum Training verwendet, was sicherstellt, dass deine Daten privat bleiben. Dies ist ein wichtiges Feature für Entwickler, die die Vertraulichkeit der Eingabedaten ihrer Anwendung wahren müssen.
Deine erste Anfrage senden
Mit deinem API-Schlüssel und der Basis-URL kannst du deine erste Anfrage senden. Die API akzeptiert standardmäßige Nachrichtenformate, einschließlich der Rollen system, user und assistant. Hier ist ein Beispiel mit cURL:
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Diese Anfrage sendet einen einfachen Prompt an das Modell. Die Antwort enthält den generierten Text sowie Token-Nutzungsstatistiken. Die zu sendende Modell-ID ist „uncensored“. Diese Kennung wird im Anfragekörper verwendet, um das Modell anzugeben.
Du kannst auch das offizielle OpenAI Python SDK verwenden. Initialisiere den Client mit deiner Basis-URL und deinem API-Schlüssel und rufe dann die Methode chat.completions.create auf. Die Antwortstruktur entspricht dem OpenAI-Format, einschließlich choices, finish_reason und Nutzungsstatistiken.
Wichtige Parameter:
- model: 'uncensored'
- messages: Array von Nachrichtenobjekten
- temperature: Steuert die Zufälligkeit (Standard 1.0)
- max_tokens: Max. Output-Token (Standard 2048)
Diese Einrichtung ermöglicht es dir, das unzensierte Modell schnell in deine Anwendung zu integrieren. Die Antwortzeit ist im Allgemeinen gering, was die direkte Infrastruktur ohne Weiterleitungs-Overhead widerspiegelt.
Streaming und Tools handhaben
Die API unterstützt Streaming über Server-Sent Events (SSE), was für Echtzeit-Benutzererfahrungen unerlässlich ist. Wenn Streaming aktiviert ist, sendet die API teilweise Antworten, sobald sie generiert werden. Der letzte Chunk enthält die gesamte Token-Nutzung, sodass du die Kosten genau verfolgen kannst. Dies ist nützlich für Chat-Schnittstellen, die Text anzeigen, während er generiert wird.
Function Calling (Tools) wird ebenfalls unterstützt. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt strukturierte JSON-Ausgaben zurück, die von deiner Anwendung analysiert und ausgeführt werden können. Dies ermöglicht komplexe Workflows, wie die Interaktion mit externen APIs oder Datenbanken.
JSON-Modus: Du kannst JSON-Ausgaben erzwingen, indem du response_format auf json_object setzt. Dies stellt sicher, dass das Modell gültiges JSON zurückgibt, was für die programmatische Verarbeitung entscheidend ist.
Andere Parameter:
- stop: Sequenzen, bei denen die API die Generierung weiterer Token stoppt.
- seed: Für reproduzierbare Ausgaben.
- presence_penalty: Ermutigt das Modell, über neue Themen zu sprechen.
- frequency_penalty: Bestraft neue Token basierend auf ihrer bestehenden Häufigkeit im Text.
Diese Funktionen machen die API für eine breite Palette von Anwendungen geeignet, von einfachen Chatbots bis hin zu komplexen Agenten-basierten Systemen.
Preise und Krypto-Zahlungen
Das Preismodell ist einfach und nutzungsbasiert. Es gibt keine monatlichen Gebühren oder Abonnements. Du zahlst nur für das, was du nutzt:
- Input-Token: 0,25 $ pro 1 Mio. Token
- Output-Token: 1,00 $ pro 1 Mio. Token
Fehler und Ablehnungen sind kostenlos, das heißt, du zahlst nicht für Token, die nicht erfolgreich generiert wurden. Das Guthaben ist prepaid und verfällt nie, sodass du es bei Bedarf aufladen kannst. Dieses Modell ist transparent und vorhersehbar, sodass du die Kosten basierend auf deiner erwarteten Token-Nutzung abschätzen kannst.
Aufladevorgang: Zahlungen werden ausschließlich per Kryptowährung akzeptiert. Du kannst mit USDT (TRC20) oder USDC (Base) aufladen. Der Mindestbetrag für eine Aufladung beträgt 10 $, der Höchstbetrag 500 $. Für größere Aufladungen erhältst du Bonusguthaben:
- Aufladung über 50 $: +5 % Bonusguthaben
- Aufladung über 100 $: +10 % Bonusguthaben
Für Guthabenstände werden keine Rückerstattungen geleistet, Fehler wie Doppelbuchungen können jedoch über die Support-Seite gelöst werden. Dieses Krypto-nur-Modell reduziert Transaktionsgebühren und vereinfacht globale Zahlungen.
Ratenlimits und Kontingente
Um eine faire Nutzung zu gewährleisten und die Leistung aufrechtzuerhalten, gelten für jeden API-Schlüssel die folgenden Limits:
- Anfragen pro Minute: 300
- Parallele Anfragen: 8
- Maximale Größe des Anfragekörpers: 8 MB
Diese Limits werden angewendet, um Missbrauch zu verhindern und eine gleichbleibende Latenz zu gewährleisten. Wenn du das Ratenlimit überschreitest, erhältst du einen 429 Too Many Requests-Fehler. Du kannst Retry-Logik mit exponentiellem Backoff implementieren, um diese Fälle angemessen zu behandeln.
Das Kontextfenster umfasst 100.000 Token, sowohl den Prompt als auch die Completion. Die maximale Ausgabe pro Anfrage beträgt 32.000 Token bzw. 2.048, wenn max_tokens nicht festgelegt ist. Dies ermöglicht Anwendungen mit langem Kontext, wie z. B. Dokumentenanalysen oder längere Gespräche.
Inhaltsgrenze: Obwohl das Modell unzensiert ist, lehnt es immer sexuellen Inhalt mit Minderjährigen ab. Dies ist eine harte Grenze, die vom Modell selbst angewendet wird.
Das Verständnis dieser Limits hilft dir, deine Anwendung so zu gestalten, dass sie Ratenlimits handhabt und die Token-Nutzung effizient verwaltet. Für die meisten Anwendungsfälle sind diese Limits ausreichend, aber Anwendungen mit hohem Durchsatz müssen möglicherweise Warteschlangenmechanismen implementieren.
Datenschutz und Datennutzung
Datenschutz ist für viele Entwickler ein wichtiges Kriterium. Dieser Dienst verwendet deine Prompts nicht zum Training. Deine Daten werden zur Generierung der Antwort verarbeitet und nicht zur langfristigen Modellverbesserung gespeichert. Dies gewährleistet, dass die Eingabedaten deiner Anwendung privat bleiben und nicht zum Training des Basismodells verwendet werden.
Datenschutz des Kontos: Für dein Konto wird lediglich eine E-Mail-Adresse benötigt. Es sind keine Telefonnummer oder persönliche Identifikationsdaten erforderlich. Dies reduziert die Menge an persönlichen Daten, die du mit dem Dienst teilst.
Datenverarbeitung: Prompts werden nicht zum Training verwendet. Dies ist ein erheblicher Vorteil für Unternehmen, die die Vertraulichkeit ihrer proprietären Daten oder Benutzereingaben wahren müssen. Der Dienst ist transparent in Bezug auf seine Datenpraktiken.
Kein Datenleck durch Trainingsdaten: Da die Prompts nicht zum Training verwendet werden, musst du keine Sorge haben, dass deine Daten in zukünftigen Modellausgaben erscheinen. Dies ist ein entscheidender Unterschied zu einigen kostenlosen oder gemeinsam genutzten Modellen, die Benutzerdaten zum Training verwenden.
Dieser datenschutzorientierte Ansatz macht die API für Unternehmensanwendungen geeignet, bei denen die Vertraulichkeit der Daten von größter Bedeutung ist. Du kannst das unzensierte Modell mit Vertrauen integrieren, da deine Daten respektiert und nicht anderweitig verwendet werden.
Fragen und Antworten
Worauf basiert das unzensierte LLM-API-Modell?
Das Modell ist ein Open-Weight-Modell, das auf unseren eigenen Servern läuft und darauf abgestimmt ist, ohne Inhaltsablehnungen für die rechtmäßige Nutzung durch Erwachsene zu antworten. Es ist kein GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama oder ein anderes Modell eines anderen Anbieters.
Wie lade ich mein Konto auf?
Du kannst nur mit Krypto aufladen: USDT (TRC20) oder USDC (Base). Der Mindestbetrag beträgt 10 $, der Höchstbetrag 500 $. Für Aufladungen ab 50 $ erhältst du Bonusguthaben.
Unterstützt die API Streaming?
Ja, die API unterstützt Streaming über Server-Sent Events (SSE). Die Token-Nutzung ist im letzten Stream-Chunk enthalten, sodass du die Kosten genau verfolgen kannst.
Wie hoch sind die Ratenlimits?
Die Limits betragen 300 Anfragen pro Minute pro Schlüssel, 8 parallele Anfragen pro Schlüssel und eine maximale Größe des Anfragekörpers von 8 MB. Diese Limits gewährleisten eine faire Nutzung und eine gleichbleibende Leistung.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.