Jak zintegrować API Unrestricted AI dla wyjść bez cenzury
Integracja nieograniczonego API AI pozwala programistom na obejście filtrów treści w wyjściach LLM poprzez bezpośrednie użycie endpointu modelu o otwartych wagach. Przewodnik ten obejmuje konfigurację techniczną, ceny i ograniczenia wdrażania API LLM bez cenzury do generowania surowych, niefiltrowanych tekstów.
Kluczowe punkty
- API korzysta ze standardowego interfejsu kompatybilnego z OpenAI, wymagając tylko zmiany adresu URL bazowego i klucza API.
- Cennik oparty jest na zużyciu: $0,25 za milion tokenów wejściowych i $1,00 za milion tokenów wyjściowych, bez opłat miesięcznych.
- Doładowania kryptowalutami za pomocą USDT lub USDC zapewniają bonusowe kredyty, a darmowe kredyty próbne są dostępne dla nowych kont.
- Model obsługuje strumieniowanie, wywoływanie funkcji i tryb JSON, ale nie oferuje osadzania (embeddings) ani generowania obrazów.
Dlaczego korzystać z API bez cenzury?
Standardowi dostawcy LLM często stosują warstwy moderacji treści, które odrzucają prompty na podstawie subiektywnych kryteriów, takich jak tropy literackie, tematy polityczne lub tematy dla dorosłych. Dla programistów budujących aplikacje, w których te odmowy psują doświadczenie użytkownika, API LLM bez cenzury zapewnia bezpośrednią ścieżkę do wyjść modelu bez tych sztucznych barier. Usługa hostuje pojedynczy model o otwartych wagach dostrojony do odpowiadania bez odmów treści dla legalnego użytku dorosłego, zapewniając spójne zachowanie w zakresie zróżnicowanych tematów.
W przeciwieństwie do agregatorów, które kierują zapytania między wieloma modelami dostawców, usługa ta korzysta z dedykowanej infrastruktury. Eliminuje to złożoność zarządzania wieloma kluczami API i różnymi formatami odpowiedzi. Model nie jest GPT, Claude, Gemini ani żadnym innym modelem dostawcy; jest to odrębny model o otwartych wagach działający na naszych serwerach. Podejście to zmniejsza opóźnienia i zapewnia, że zachowanie „bez cenzury” jest spójne, ponieważ zależy od dostrojenia modelu bazowego, a nie dynamicznej warstwy moderacji stosowanej przez agregatora stron trzecich.
Jednak nie jest to uniwersne rozwiązanie. Jeśli potrzebujesz osadzania (embeddings), generowania obrazów lub wyboru wielu modeli, to API tylko tekstowe może nie pasować do Twojego stosu technologicznego. Jest zaprojektowane specjalnie dla programistów, którzy potrzebują surowych wyjść tekstowych i chcą uniknąć narzutów związanych z kierowaniem modeli lub nieprzewidywalności interfejsów czatu internetowego.
Zrozumienie interfejsu kompatybilnego z OpenAI
API podąża za standardowym schematem chat-completions OpenAI, co ułatwia integrację programistom zaznajomionym z SDK OpenAI. Wchodzisz w interakcję z endpointem za pomocą standardowych metod HTTP, głównie POST dla uzupełnień i GET dla informacji o modelu. Adres URL bazowy to https://api.unrestrictedai.cc/v1,, a dowolnego klienta kompatybilnego z OpenAI możesz użyć, aktualizując base_url i podając swój klucz API.
Podstawowy endpoint to POST /v1/chat/completions, który przyjmuje tablicę wiadomości i zwraca odpowiedź tekstową. Dodatkowe endpointy obejmują GET /v1/models do listowania dostępnych modeli. Nie ma endpointów do osadzania (embeddings), audio, wideo ani do dostrajania (fine-tuning). Ta prostota zmniejsza krzywą uczenia się i pozwala na podmianę na model bez cenzury przy minimalnych zmianach kodu.
- Metoda: POST dla uzupełnień, GET dla informacji o modelu.
- Format: Ciało żądania JSON z tablicą wiadomości.
- Odpowiedź: Obiekt JSON zawierający wygenerowany tekst.
- Kompatybilność: Działa z oficjalnymi SDK OpenAI i klientami stron trzecich, takimi jak LangChain lub LlamaIndex.
Ten interfejs zapewnia, że istniejąca baza kodu może wykorzystać możliwości bez cenzury bez konieczności całkowitej zmiany kodu. Kontrolujesz parametry, takie jak temperature i top_p, aby dostosować kreatywność i deterministyczność wyjść.
Konfiguracja klucza API Unrestricted AI
Rozpoczęcie wymaga konta, które można utworzyć poprzez „Kontynuuj z Google” lub poprzez rejestrację adresem e-mail i hasłem. Nie jest wymagany numer telefonu, a proces jest zaprojektowany pod kątem szybkości. Po rejestracji zostajesz przekierowany na stronę „Pobierz klucz API”, gdzie Twój klucz API jest wyświetlany natychmiast. Klucz ten służy do uwierzytelniania wszystkich zapytań do API.
Każde konto jest ograniczone do jednego aktywnego klucza. Jeśli wygenerujesz nowy klucz, poprzedni zostanie unieważniony. Upraszcza to zarządzanie bezpieczeństwem, ponieważ nie musisz śledzić wielu kluczy dla jednego konta. Klucz daje dostęp do modelu bez cenzury i jest rozliczany na podstawie rzeczywistego zużycia tokenów.
Kredyty próbne: Każde nowe konto otrzymuje $0,50 kredytu próbnego, ważnego przez 7 dni. Nie jest wymagana karta kredytowa do odebrania tej próby, co ułatwia przetestowanie API przed zobowiązaniem się do zakupu. Próba jest jedna na osobę i nie może być łączona z innymi ofertami.
Prywatność: Twoje konto wymaga tylko adresu e-mail. Prompty wysłane do API nie są używane do trenowania, co zapewnia prywatność Twoich danych. Jest to kluczowa funkcja dla programistów, którzy muszą zachować poufność danych wejściowych swojej aplikacji.
Wykonanie pierwszego zapytania
Mając gotowy klucz API i adres URL bazowy, możesz wykonać pierwsze zapytanie. API akceptuje standardowe formaty wiadomości, w tym role systemową, użytkownika i asystenta. Oto przykład przy użyciu cURL:
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'To zapytanie wysyła prosty prompt do modelu. Odpowiedź będzie zawierać wygenerowany tekst wraz ze statystykami użycia tokenów. Identyfikator modelu do wysłania to „uncensored”. Identyfikator ten jest używany w ciele żądania do określenia modelu.
Możesz również użyć oficjalnego SDK Python OpenAI. Zainicjuj klienta swoim adresem URL bazowym i kluczem API, a następnie wywołaj metodę chat.completions.create. Struktura odpowiedzi odpowiada formatowi OpenAI, w tym choices, finish_reason i statystyki użycia.
Kluczowe parametry:
- model: 'uncensored'
- messages: Tablica obiektów wiadomości
- temperature: Kontroluje losowość (domyślnie 1.0)
- max_tokens: Maksymalna liczba tokenów wyjściowych (domyślnie 2048)
Ta konfiguracja pozwala szybko zintegrować model bez cenzury z Twoją aplikacją. Czas odpowiedzi jest zazwyczaj niski, co odzwierciedla bezpośrednią infrastrukturę bez narzutów kierowania.
Obsługa strumieniowania i narzędzi
API obsługuje strumieniowanie za pomocą zdarzeń wysłanych przez serwer (SSE), co jest kluczowe dla doświadczeń użytkownika w czasie rzeczywistym. Gdy strumieniowanie jest włączone, API wysyła częściowe odpowiedzi w miarę ich generowania. Ostatni fragment zawiera całkowite wykorzystanie tokenów, pozwalając na dokładne śledzenie kosztów. Jest to przydatne dla interfejsów czatu, które wyświetlają tekst w miarę jego generowania.
Wywoływanie funkcji (narzędzia) jest również obsługiwane. Możesz zdefiniować narzędzia w swoim żądaniu, a model zwróci strukturalny wynik JSON, który może być zinterpretowany i wykonany przez Twoją aplikację. Umożliwia to złożone przepływy pracy, takie jak interakcja z zewnętrznymi API lub bazami danych.
Tryb JSON: Możesz wymusić wynik JSON, ustawiając response_format na json_object. Zapewnia to, że model zwróci poprawny JSON, co jest krytyczne dla przetwarzania programistycznego.
Inne parametry:
- stop: Sekwencje, w których API przestanie generować dalsze tokeny.
- seed: Dla odtwarzalnych wyników.
- presence_penalty: Zachęca model do poruszania nowych tematów.
- frequency_penalty: Karze nowe tokeny na podstawie ich istniejącej częstotliwości w tekście.
Te funkcje sprawiają, że API jest odpowiednie dla szerokiego zakresu zastosowań, od prostych botów czatu po złożone systemy oparte na agentach.
Cennik i płatności kryptowalutami
Model cenowy jest prosty i oparty na zużyciu. Nie ma miesięcznych opłat ani subskrypcji. Płacisz za to, czego używasz:
- Tokeny wejściowe: $0,25 za 1 mln tokenów
- Tokeny wyjściowe: $1,00 za 1 mln tokenów
Błędy i odrzucenia są darmowe, co oznacza, że nie płacisz za tokeny, które nie zostały wygenerowane pomyślnie. Kredyt jest przedpłacony i nigdy nie wygasa, więc możesz go doładować w razie potrzeby. Ten model jest przejrzysty i przewidywalny, co pozwala oszacować koszty na podstawie przewidywanego zużycia tokenów.
Proces doładowania: Płatności akceptowane są wyłącznie za pomocą kryptowalut. Możesz doładować konto za pomocą USDT (TRC20) lub USDC (Base). Minimalna kwota doładowania to $10, a maksymalna to $500. Za większe doładowania przyznawane są kredyty bonusowe:
- Doładowanie $50: +5% kredytu bonusowego
- Doładowanie $100: +10% kredytu bonusowego
Zwrotów salda kredytu nie wydaje się, ale błędy takie jak podwójne obciążenia można rozwiązać na stronie Wsparcia. Ten model oparty wyłącznie na kryptowalutach zmniejsza opłaty transakcyjne i upraszcza płatności międzynarodowe.
Limity zapytań i limity
Aby zapewnić uczciwe użytkowanie i utrzymać wydajność, API stosuje następujące limity dla każdego klucza API:
- Zapytania na minutę: 300
- Zapytania równoległe: 8
- Maksymalny rozmiar ciała zapytania: 8 MB
Limity te są stosowane w celu zapobiegania nadużyciom i zapewnienia stałego czasu opóźnień. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429 Too Many Requests. Możesz zaimplementować logikę ponownych prób z wykładniczym opóźnieniem, aby obsłużyć te przypadki w sposób elegancki.
Okno kontekstu wynosi 100 000 tokenów, co obejmuje zarówno prompt, jak i uzupełnienie. Maksymalna ilość danych wyjściowych na zapytanie to 32 000 tokenów lub 2 048, jeśli nie ustawiono max_tokens. Pozwala to na tworzenie aplikacji obsługujących długie konteksty, takich jak analiza dokumentów lub przedłużone rozmowy.
Ścisły limit treści: Mimo że model jest bez cenzury, zawsze odrzuca treści seksualne z udziałem małoletnich. Jest to ścisły limit narzucony przez sam model.
Zrozumienie tych limitów pomaga zaprojektować aplikację tak, aby radziła sobie z limitami zapytań i efektywnie zarządzała zużyciem tokenów. W większości przypadków użycia limity te są wystarczające, ale aplikacje o wysokim przepływie mogą potrzebować wdrożenia mechanizmów buforowania.
Prywatność i wykorzystanie danych
Prywatność jest kluczowym aspektem dla wielu programistów. Usługa nie wykorzystuje Twoich promptów do trenowania. Twoje dane są przetwarzane w celu wygenerowania odpowiedzi i nie są przechowywane w celu długoterminowego ulepszania modelu. Zapewnia to, że dane wejściowe Twojej aplikacji pozostają prywatne i nie są wykorzystywane do trenowania modelu bazowego.
Prywatność konta: Twoje konto wymaga tylko adresu e-mail. Nie jest wymagany numer telefonu ani identyfikacja osobowa. Zmniejsza to ilość danych osobowych, które udostępniasz usłudze.
Obsługa danych: Prompty nie są wykorzystywane do trenowania. Jest to istotna zaleta dla firm, które muszą zachować poufność swoich danych własnościowych lub danych użytkowników. Usługa została zaprojektowana tak, aby być przejrzystą w zakresie praktyk dotyczących danych.
Brak wycieku danych treningowych: Ponieważ prompty nie są wykorzystywane do trenowania, nie musisz martwić się o pojawienie się swoich danych w przyszłych wynikach modelu. Jest to kluczowa różnica w porównaniu do niektórych darmowych lub współdzielonych modeli, które wykorzystują dane użytkowników do trenowania.
Takie podejście nastawione na prywatność sprawia, że API nadaje się do zastosowań korporacyjnych, w których poufność danych jest kluczowa. Możesz zintegrować model bez cenzury z pełnym przekonaniem, wiedząc, że Twoje dane są szanowane i nie są wykorzystywane w innych celach.
Pytania i odpowiedzi
Na czym opiera się model API LLM bez cenzury?
Model jest modelem o otwartych wagach uruchamianym na naszych własnych serwerach, dostrojonym do odpowiadania bez odrzucania treści dla prawnego użytku dorosłego. Nie jest to GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama ani żaden inny model dostawcy.
Jak doładować moje konto?
Możesz doładować konto wyłącznie za pomocą kryptowalut: USDT (TRC20) lub USDC (Base). Minimalna kwota to $10, a maksymalna to $500. Kredyty bonusowe są przyznawane za doładowania na kwotę $50 lub więcej.
Czy API obsługuje strumieniowanie?
Tak, API obsługuje strumieniowanie za pomocą Server-Sent Events (SSE). Wykorzystanie tokenów jest uwzględniane w ostatnim pakiecie strumienia, co pozwala na dokładne śledzenie kosztów.
Jakie są limity zapytań?
Limity to 300 zapytań na minutę na klucz, 8 równoległych zapytań na klucz i maksymalny rozmiar ciała zapytania wynoszący 8 MB. Limity te zapewniają uczciwe użytkowanie i stałą wydajność.
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień bazowy URL. To cała konfiguracja.