Hoe integreer je een Unrestricted AI API voor ongecensureerde outputs
Het integreren van een unrestricted AI API stelt ontwikkelaars in staat om inhoudsfilters in LLM-outputs te omzeilen door een directe, open-weight model endpoint te gebruiken. Deze gids behandelt de technische setup, prijzen en beperkingen van het implementeren van een ongecensureerde LLM API voor ruwe, ongefilterde tekstgeneratie.
Belangrijkste punten
- De API gebruikt een standaard OpenAI-compatible interface, waarbij alleen een wijziging van de base URL en een API-sleutel nodig is.
- Prijzen zijn gebruik-afhankelijk: $0,25 per miljoen input-tokens en $1,00 per miljoen output-tokens, zonder maandelijkse kosten.
- Crypto-opwaarderingen via USDT of USDC bieden bonus tegoeden, terwijl gratis proeftegoed beschikbaar is voor nieuwe accounts.
- Het model ondersteunt streaming, function calling en JSON-modus, maar biedt geen embeddings of image generatie.
Waarom een ongecensureerde API gebruiken?
Standaard LLM-providers passen vaak lagen voor inhoudsmodificatie toe die prompts weigeren op basis van subjectieve criteria, zoals creatieve schrijftroepen, politieke onderwerpen of volwassen thema's. Voor ontwikkelaars die applicaties bouwen waar deze weigeringen de gebruikerservaring verstoren, biedt een ongecensureerde LLM API een directe weg naar modeloutputs zonder deze kunstmatige barrières. Deze dienst host een enkel open-weight model dat is getuned om zonder inhoudsrefusals te antwoorden voor wettelijk volwassen gebruik, wat zorgt voor consistent gedrag over diverse onderwerpen.
In tegenstelling tot aggregators die verzoeken tussen meerdere leveranciersmodellen routeren, gebruikt deze dienst een toegewijde infrastructuur. Dit elimineert de complexiteit van het beheren van meerdere API-sleutels en verschillende responsformaten. Het model is geen GPT, Claude, Gemini of enig ander model van een leverancier; het is een apart open-weight model dat op onze servers draait. Deze aanpak vermindert latentie en zorgt ervoor dat het 'ongecensureerde' gedrag consistent is, omdat het afhangt van de tuning van het basismodel in plaats van een dynamische modificatielaag die door een derde partij wordt toegepast.
Dit is echter geen universele oplossing. Als je embeddings, image generatie of meerdere modelkeuzes nodig hebt, past deze tekst-only API mogelijk niet in je stack. Het is specifiek ontworpen voor ontwikkelaars die ruwe tekstoutputs nodig hebben en de overhead van modelrouting of de onvoorspelbaarheid van web-chat UI's willen vermijden.
De OpenAI-compatible interface begrijpen
De API volgt de standaard OpenAI chat-completions schema, waardoor integratie eenvoudig is voor ontwikkelaars die al bekend zijn met OpenAI SDKs. Je communiceert met het endpoint via standaard HTTP-methoden, voornamelijk POST voor completions en GET voor modelinformatie. De base URL is https://api.unrestrictedai.cc/v1, en je kunt elke OpenAI-compatible client gebruiken door de base_url bij te werken en je API-sleutel te verstrekken.
Het kern-endpoint is POST /v1/chat/completions, dat een berichtarray accepteert en een tekstresponse retourneert. Aanvullende endpoints zijn GET /v1/models voor het opvragen van beschikbare modellen. Er zijn geen embeddings-, audio-, video- of fine-tuning-endpoints. Deze eenvoud vermindert de leercurve en stelt je in staat het ongecensureerde model met minimale code-aanpassingen te gebruiken.
- Methode: POST voor completions, GET voor modelinfo.
- Formaat: JSON verzoeklichaam met messages array.
- Respons: JSON object met de gegenereerde tekst.
- Compatibiliteit: Werkt met officiële OpenAI SDKs en third-party clients zoals LangChain of LlamaIndex.
Deze interface zorgt ervoor dat je bestaande codebase de ongecensureerde mogelijkheden kan benutten zonder een volledige herschrijving. Je bestuurt de parameters, zoals temperature en top_p, om de creativiteit en determinisme van de outputs af te stemmen.
Je Unrestricted AI API-sleutel instellen
Aan de slag vereist een account, dat kan worden aangemaakt via 'Continue with Google' of door je te registreren met een e-mailadres en wachtwoord. Er is geen telefoonnummer nodig en het proces is ontworpen voor snelheid. Na het aanmelden word je doorgestuurd naar de pagina 'Get API key', waar je API-sleutel direct wordt weergegeven. Deze sleutel wordt gebruikt om alle verzoeken aan de API te verifiëren.
Elk account is beperkt tot één actieve sleutel. Als je een nieuwe sleutel genereert, wordt de vorige ongeldig gemaakt. Dit vereenvoudigt het veiligheidsbeheer, omdat je geen meerdere sleutels hoeft bij te houden voor één account. De sleutel geeft toegang tot het ongecensureerde model en wordt gefactureerd op basis van echt tokengebruik.
Proeftegoed: Elke nieuwe account ontvangt $0,50 aan proeftegoed, geldig voor 7 dagen. Er is geen creditcard nodig om dit proeftegoed te claimen, wat het testen van de API vergemakkelijkt voordat je je commit aan een aankoop. Het proeftegoed is één keer per persoon en kan niet worden gecombineerd met andere aanbiedingen.
Privacy: Voor je account is alleen een e-mailadres nodig. Prompts die naar de API worden gestuurd, worden niet gebruikt voor training, waardoor wordt gewaarborgd dat je gegevens privé blijven. Dit is een belangrijk kenmerk voor ontwikkelaars die vertrouwelijkheid over de invoergegevens van hun applicatie moeten bewaren.
Je eerste verzoek doen
Met je API-sleutel en base URL kun je je eerste verzoek doen. De API accepteert standaard message formaten, inclusief system, user en assistant rollen. Hier is een voorbeeld met cURL:
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Dit verzoek stuurt een eenvoudige prompt naar het model. De respons bevat de gegenereerde tekst, samen met token usage statistieken. De model id die je moet versturen is 'uncensored'. Deze identifier wordt gebruikt in het verzoeklichaam om het model te specificeren.
Je kunt ook de officiële OpenAI Python SDK gebruiken. Initialiseer de client met je base URL en API-sleutel en roep vervolgens de chat.completions.create methode aan. De responsstructuur komt overeen met het OpenAI-formaat, inclusief choices, finish_reason en usage statistieken.
Belangrijke parameters:
- model: 'uncensored'
- messages: Array van message objecten
- temperature: Regelt willekeur (standaard 1.0)
- max_tokens: Max output tokens (standaard 2048)
Deze setup stelt je in staat om het ongecensureerde model snel in je applicatie te integreren. De responstijd is over het algemeen laag, wat de directe infrastructuur zonder routing overhead weerspiegelt.
Streaming en tools afhandelen
De API ondersteunt streaming via Server-Sent Events (SSE), wat essentieel is voor realtime gebruikerservaringen. Wanneer streaming is ingeschakeld, stuurt de API partiële responsen zodra ze worden gegenereerd. Het laatste chunk bevat het totale tokengebruik, zodat je de kosten nauwkeurig kunt bijhouden. Dit is nuttig voor chatinterfaces die tekst weergeven terwijl deze wordt gegenereerd.
Function calling (tools) wordt ook ondersteund. Je kunt tools definiëren in je verzoek en het model retourneert gestructureerde JSON output die door je applicatie kan worden verwerkt en uitgevoerd. Dit maakt complexe workflows mogelijk, zoals het interacteren met externe API's of databases.
JSON-modus: Je kunt JSON-output afdwingen door response_format in te stellen op json_object. Dit zorgt ervoor dat het model geldige JSON retourneert, wat essentieel is voor programmatische verwerking.
Andere parameters:
- stop: Sequenties waarbij de API stopt met het genereren van verdere tokens.
- seed: Voor reproduceerbare outputs.
- presence_penalty: Moedigt het model aan om over nieuwe onderwerpen te praten.
- frequency_penalty: Straft nieuwe tokens af op basis van hun bestaande frequentie in de tekst.
Deze functies maken de API geschikt voor een breed scala aan applicaties, van eenvoudige chatbots tot complexe agent-based systemen.
Prijzen en cryptobetalingen
Het prijsmodel is eenvoudig en gebruiksgespecificeerd. Er zijn geen maandelijkse kosten of abonnementen. Je betaalt voor wat je gebruikt:
- Invoer-tokens: $0,25 per 1M tokens
- Uitvoer-tokens: $1,00 per 1M tokens
Fouten en weigeringen zijn gratis, wat betekent dat je niet betaalt voor tokens die niet succesvol zijn gegenereerd.tegoed is prepaid en verloopt nooit, dus je kunt opwaarderen wanneer je dat nodig hebt. Dit model is transparant en voorspelbaar, zodat je kosten kunt schatten op basis van je verwachte tokengebruik.
Opwaardeerproces: Betalingen worden alleen geaccepteerd via cryptocurrency. Je kunt opwaarderen met USDT (TRC20) of USDC (Base). Het minimale opwaardeerbedrag is $10 en het maximum is $500. Bonus tegoed wordt toegekend bij grotere opwaarderingen:
- $50 Opwaarderen: +5% bonus tegoed
- $100 Opwaarderen: +10% bonus tegoed
Terugbetalingen worden niet uitgegeven voor tegoedsaldi, maar fouten zoals dubbele afschrijvingen kunnen worden opgelost via de Support-pagina. Dit crypto-only model vermindert transactiekosten en vereenvoudigt wereldwijde betalingen.
Rate Limits en quota's
Om eerlijk gebruik te garanderen en de prestaties te behouden, hanteert de API de volgende limieten per API-sleutel:
- Verzoeken per minuut: 300
- Gelijktijdige verzoeken: 8
- Maximale grootte van het verzoeklichaam: 8 MB
Deze limieten worden toegepast om misbruik te voorkomen en een consistente latentie te garanderen. Als je de rate limit overschrijdt, ontvang je een 429 Too Many Requests-fout. Je kunt retry-logica implementeren met exponentiële backoff om deze gevallen soepel af te handelen.
Het contextvenster is 100.000 tokens, wat zowel de prompt als de gegenereerde tekst omvat. De maximale output per verzoek is 32.000 tokens, of 2.048 als max_tokens niet is ingesteld. Dit maakt toepassingen met lange context mogelijk, zoals documentanalyse of uitgebreide gesprekken.
Harde inhoudslimiet: Hoewel het model ongecensureerd is, weigert het altijd seksuele inhoud met minderjarigen. Dit is een harde limiet die door het model zelf wordt toegepast.
Het begrijpen van deze limieten helpt je je applicatie zo in te richten dat deze omgaat met rate limiting en tokengebruik efficiënt beheert. Voor de meeste use cases zijn deze limieten voldoende, maar applicaties met hoge doorvoer moeten mogelijk wachtrijmechanismen implementeren.
Privacy en gegevensgebruik
Privacy is een belangrijke overweging voor veel ontwikkelaars. Deze dienst gebruikt je prompts niet voor training. Je gegevens worden verwerkt om de respons te genereren en worden niet opgeslagen voor langetermijnmodelverbetering. Dit zorgt ervoor dat de invoergegevens van je applicatie privé blijven en niet worden gebruikt om het basismodel te trainen.
Accountprivacy: Je account vereist alleen een e-mailadres. Er is geen telefoonnummer of persoonlijke identificatie nodig. Dit vermindert de hoeveelheid persoonlijke gegevens die je deelt met de dienst.
Gegevensafhandeling: Prompts worden niet gebruikt voor training. Dit is een aanzienlijk voordeel voor bedrijven die vertrouwelijkheid over hun eigendomsgegevens of gebruikersinvoer moeten handhaven. De dienst is ontworpen om transparant te zijn over zijn gegevenspraktijken.
Geen lek van trainingsdata: Omdat de prompts niet worden gebruikt voor training, hoef je je geen zorgen te maken dat je gegevens in toekomstige modeloutputs verschijnen. Dit is een belangrijk onderscheidend kenmerk ten opzichte van sommige gratis of gedeelde modellen die gebruikersdata voor training gebruiken.
Deze privacy-first aanpak maakt de API geschikt voor enterprise-toepassingen waar gegevensvertrouwelijkheid voorop staat. Je kunt het ongecensureerde model met vertrouwen integreren, wetende dat je gegevens worden gerespecteerd en niet voor andere doeleinden worden gebruikt.
Vragen en antwoorden
Waar is het ongecensureerde llm api model op gebaseerd?
Het model is een open-weight model dat op onze eigen servers draait, afgestemd om te antwoorden zonder inhoudsweigeringen voor wettelijk volwassen gebruik. Het is geen GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama of enig ander model van een leverancier.
Hoe laad ik mijn account op?
Je kunt alleen met crypto opwaarderen: USDT (TRC20) of USDC (Base). Het minimale bedrag is $10 en het maximum is $500. Bonus tegoed wordt toegekend bij een opwaardering van $50 of meer.
Ondersteunt de API streaming?
Ja, de API ondersteunt streaming via Server-Sent Events (SSE). Tokengebruik is opgenomen in het laatste chunk van de stream, zodat je kosten nauwkeurig kunt volgen.
Wat zijn de rate limits?
De limieten zijn 300 verzoeken per minuut per sleutel, 8 gelijktijdige verzoeken per sleutel en een maximale grootte van het verzoeklichaam van 8 MB. Deze limieten zorgen voor eerlijk gebruik en consistente prestaties.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.