KO ▾
API 키 받기

Unrestricted AI API 무검열 출력 연동 방법

제한 없는 AI API를 통합하면 개발자는 직접적인 오픈 웨이트 모델 엔드포인트를 사용하여 LLM 출력의 콘텐츠 필터를 우회할 수 있습니다. 이 가이드는 원시 필터링되지 않은 텍스트 생성을 위한 무검열 LLM API 배포를 위한 기술 설정, 가격 및 제약 사항을 다룹니다.

업데이트

주요 포인트

무검열 API를 사용해야 하는 이유?

표준 LLM 공급업체는 종종 창의적 글쓰기 관용구, 정치적 주제 또는 성인 테마와 같은 주관적인 기준에 따라 프롬프트를 거부하는 콘텐츠 검토 레이어를 적용합니다. 이러한 거부가 사용자 경험을 깨는 애플리케이션을 구축하는 개발자에게 무검열 LLM API는 이러한 인공적인 장벽 없이 모델 출력에 직접 접근할 수 있는 경로를 제공합니다. 이 서비스는 합법적인 성인용 콘텐츠에 대해 콘텐츠 거부 없이 답변하도록 튜닝된 단일 오픈 웨이트 모델을 호스팅하여 다양한 주제에 걸쳐 일관된 동작을 보장합니다.

여러 벤더 모델 간에 요청을 라우팅하는 애그리게이터와 달리 이 서비스는 전용 인프라를 사용합니다. 이는 여러 API 키와 다양한 응답 형식을 관리하는 복잡성을 제거합니다. 이 모델은 GPT, Claude, Gemini 또는 기타 벤더의 모델이 아니며, 당사 서버에서 실행되는 별도의 오픈 웨이트 모델입니다. 이 접근 방식은 지연 시간을 줄이고 '무검열' 동작이 서드파티 애그리게이터에 의해 적용되는 동적 검토 레이어가 아닌 기본 모델의 튜닝에 의존하므로 일관되도록 보장합니다.

하지만 이것이 만능 해결책은 아닙니다. 임베딩, 이미지 생성 또는 여러 모델 선택이 필요한 경우 이 텍스트 전용 API는 귀하의 스택에 적합하지 않을 수 있습니다. 이 API는 모델 라우팅의 오버헤드를 피하거나 웹 채팅 UI의 예측 불가능함을 피하고 원시 텍스트 출력이 필요한 개발자를 위해 특별히 설계되었습니다.

OpenAI 호환 인터페이스 이해하기

API는 표준 OpenAI chat-completions 스키마를 따르므로 이미 OpenAI SDK에 익숙한 개발자에게 통합이 간단합니다. 표준 HTTP 메서드를 사용하여 엔드포인트와 상호 작용하며, 주로 완료에는 POST, 모델 정보에는 GET을 사용합니다. 기본 URL은 https://api.unrestrictedai.cc/v1,이며, base_url을 업데이트하고 API 키를 제공하여 모든 OpenAI 호환 클라이언트를 사용할 수 있습니다.

핵심 엔드포인트는 POST /v1/chat/completions으로, 메시지 배열을 받아 텍스트 응답을 반환합니다. 추가 엔드포인트에는 사용 가능한 모델 목록을 나열하는 GET /v1/models가 있습니다. 임베딩, 오디오, 비디오 또는 파인튜닝 엔드포인트는 없습니다. 이러한 단순성은 학습 곡선을 줄이고 최소한의 코드 변경으로 무검열 모델을 교체할 수 있게 합니다.

  • 메서드: 완료에는 POST, 모델 정보에는 GET.
  • 형식: 메시지 배열이 포함된 JSON 요청 본문.
  • 응답: 생성된 텍스트를 포함하는 JSON 객체.
  • 호환성: 공식 OpenAI SDK 및 LangChain 또는 LlamaIndex와 같은 서드파티 클라이언트와 작동합니다.

이 인터페이스는 기존 코드베이스를 전체 다시 작성 없이 무검열 기능을 활용할 수 있게 합니다. temperature와 top_p과 같은 매개변수를 제어하여 출력의 창의성과 결정론을 조정할 수 있습니다.

Unrestricted AI API 키 설정하기

시작하려면 계정이 필요하며, 'Google로 계속하기' 또는 이메일과 비밀번호로 등록하여 생성할 수 있습니다. 전화번호는 필요하지 않으며, 이 과정은 속도를 위해 설계되었습니다. 가입 시 'API 키 받기' 페이지로 이동하며, API 키가 즉시 표시됩니다. 이 키는 API로의 모든 요청을 인증하는 데 사용됩니다.

각 계정에는 활성 키가 하나만 제한됩니다. 새 키를 생성하면 이전 키가 무효화됩니다. 이는 단일 계정에 여러 키를 추적할 필요가 없으므로 보안 관리를 단순화합니다. 이 키는 무검열 모델에 대한 접근 권한을 부여하며, 실제 토큰 사용량에 따라 요금이 청구됩니다.

체험 크레딧: 모든 새 계정에는 7일 동안 유효한 $0.50의 체험 크레딧이 제공됩니다. 이 체험을 청구하려면 신용카드가 필요 없으므로 구매 전에 API를 쉽게 테스트할 수 있습니다. 체험은 1인당 1회 제공되며 다른 혜택과 결합할 수 없습니다.

개인정보: 계정에는 이메일 주소만 필요합니다. API로 전송된 프롬프트는 학습에 사용되지 않으므로 데이터가 비공개로 유지됩니다. 이는 애플리케이션의 입력 데이터에 대한 기밀성을 유지해야 하는 개발자에게 중요한 기능입니다.

첫 번째 요청 보내기

API 키와 기본 URL이 준비되면 첫 번째 요청을 보낼 수 있습니다. API는 시스템, 사용자 및 어시스턴트 역할을 포함한 표준 메시지 형식을 받습니다. 다음은 cURL을 사용한 예시입니다:


curl https://api.unrestrictedai.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

이 요청은 모델에 간단한 프롬프트를 보냅니다. 응답에는 생성된 텍스트와 함께 토큰 사용 통계가 포함됩니다. 보내야 하는 모델 ID는 'uncensored'입니다. 이 식별자는 요청 본문에서 모델을 지정하는 데 사용됩니다.

공식 OpenAI Python SDK도 사용할 수 있습니다. 기본 URL과 API 키로 클라이언트를 초기화한 후 chat.completions.create 메서드를 호출합니다. 응답 구조는 choices, finish_reason 및 사용 통계를 포함하여 OpenAI 형식과 일치합니다.

주요 매개변수:

  • model: 'uncensored'
  • messages: 메시지 객체 배열
  • temperature: 무작위성 제어 (기본값 1.0)
  • max_tokens: 최대 출력 토큰 (기본값 2048)

이 설정을 통해 무검열 모델을 애플리케이션에 빠르게 통합할 수 있습니다. 응답 시간은 일반적으로 라우팅 오버헤드가 없는 직접 인프라로 인해 낮습니다.

스트리밍 및 도구 처리

API는 실시간 사용자 경험에 필수적인 서버 전송 이벤트(SSE)를 통한 스트리밍을 지원합니다. 스트리밍이 활성화되면 API는 생성되는 대로 부분 응답을 보냅니다. 마지막 청크에는 총 토큰 사용량이 포함되어 비용 추적을 정확하게 할 수 있습니다. 이는 생성되는 텍스트를 표시하는 채팅 인터페이스에 유용합니다.

함수 호출(도구)도 지원됩니다. 요청에서 도구를 정의하면 모델은 애플리케이션에서 구문 분석하고 실행할 수 있는 구조화된 JSON 출력을 반환합니다. 이는 외부 API 또는 데이터베이스와 상호 작용하는 복잡한 워크플로우를 가능하게 합니다.

JSON 모드: response_format을 json_object로 설정하여 JSON 출력을 강제할 수 있습니다. 이는 프로그래밍 방식으로 소비하는 데 중요한 유효한 JSON을 모델이 반환하도록 보장합니다.

기타 매개변수:

  • stop: API가 추가 토큰 생성을 중지하는 시퀀스입니다.
  • seed: 재현 가능한 출력을 위해.
  • presence_penalty: 모델이 새로운 주제에 대해 이야기하도록 유도합니다.
  • frequency_penalty: 텍스트에서 기존 빈도에 따라 새 토큰에 패널티를 부여합니다.

이러한 기능은 단순한 챗봇부터 복잡한 에이전트 기반 시스템에 이르기까지 다양한 애플리케이션에 API를 적합하게 만듭니다.

가격 및 암호화폐 결제

가격 모델은 단순하고 사용량 기반입니다. 월 구독료나 구독 요금이 없습니다. 사용한 만큼만 지불합니다:

  • 입력 토큰: 토큰 100만 개당 $0.25
  • 출력 토큰: 토큰 100만 개당 $1.00

오류와 거절은 무료입니다. 즉, 성공적으로 생성되지 않은 토큰에 대해서는 요금이 부과되지 않습니다. 크레딧은 선불이며 만료되지 않으므로 필요할 때 충전할 수 있습니다. 이 모델은 투명하고 예측 가능하여 예상 토큰 사용량을 기준으로 비용을 추정할 수 있습니다.

충전 과정: 결제는 암호화폐로만 가능합니다. USDT(TRC20) 또는 USDC(Base)로 충전할 수 있습니다. 최소 충전 금액은 $10, 최대 충전 금액은 $500입니다. 큰 금액을 충전하면 보너스 크레딧이 제공됩니다:

  • $50 충전: +5% 보너스 크레딧
  • $100 충전: +10% 보너스 크레딧

크레딧 잔액에 대해서는 환불이 제공되지 않지만, 중복 청구와 같은 오류는 지원 페이지를 통해 해결할 수 있습니다. 이 암호화폐 전용 모델은 거래 수수료를 줄이고 글로벌 결제를 단순화합니다.

속도 제한 및 할당량

공정한 사용과 성능 유지를 위해 API는 각 API 키당 다음 제한을 적용합니다:

  • 분당 요청: 300
  • 동시 요청: 8
  • 최대 요청 본문 크기: 8 MB

이러한 제한은 남용을 방지하고 일관된 지연 시간을 보장하기 위해 적용됩니다. 속도 제한을 초과하면 429 Too Many Requests 오류가 발생합니다. 이러한 경우를 처리하기 위해 지수 백오프 재시도 로직을 구현할 수 있습니다.

컨텍스트 창은 100,000 토큰이며, 여기에는 프롬프트와 완성(completion)이 모두 포함됩니다. 요청당 최대 출력은 32,000 토큰이며, max_tokens이 설정되지 않은 경우 2,048 토큰입니다. 이는 문서 분석이나 긴 대화와 같은 긴 컨텍스트 애플리케이션에 적합합니다.

Hard Content Limit: 모델은 무검열이지만 미성년자가 포함된 성적 콘텐츠는 항상 거부합니다. 이는 모델 자체에서 적용되는 Hard Content Limit입니다.

이러한 제한을 이해하면 속도 제한을 처리하고 토큰 사용을 효율적으로 관리하기 위해 애플리케이션을 설계하는 데 도움이 됩니다. 대부분의 사용 사례에는 이러한 제한이 충분하지만, 높은 처리량이 필요한 애플리케이션은 큐잉 메커니즘을 구현해야 할 수 있습니다.

프라이버시 및 데이터 사용

프라이버시는 많은 개발자에게 중요한 고려 사항입니다. 이 서비스는 프롬프트를 학습에 사용하지 않습니다. 데이터는 응답 생성을 위해 처리되며 장기적인 모델 개선을 위해 저장되지 않습니다. 이를 통해 애플리케이션의 입력 데이터가 비공개로 유지되고 기본 모델 학습에 사용되지 않습니다.

계정 프라이버시: 계정 생성에는 이메일 주소만 필요합니다. 전화번호나 개인 신원 확인이 필요하지 않습니다. 이는 서비스에 공유하는 개인 데이터의 양을 줄입니다.

데이터 처리: 프롬프트는 학습에 사용되지 않습니다. 이는 자체 데이터나 사용자 입력의 기밀성을 유지해야 하는 기업에 중요한 장점입니다. 이 서비스는 데이터 관행에 대해 투명하도록 설계되었습니다.

학습 데이터 유출 없음: 프롬프트가 학습에 사용되지 않으므로 데이터가 향후 모델 출력에 나타날 것을 걱정할 필요가 없습니다. 이는 사용자 데이터를 학습에 사용하는 일부 무료 또는 공유 모델과 구별되는 주요 차별점입니다.

이 개인정보 보호 중심의 접근 방식은 데이터 기밀성이 가장 중요한 기업용 애플리케이션에 API를 적합하게 만듭니다. 귀하의 데이터가 존중되고 재사용되지 않는다는 것을 알고 있으므로, 자신감을 가지고 무검열 모델을 통합할 수 있습니다.

질문과 답변

무검열 LLM API 모델은 무엇에 기반합니까?

이 모델은 자체 서버에서 실행되는 오픈 웨이트 모델로, 합법적인 성인 사용에 대해 콘텐츠 거절 없이 답변하도록 튜닝되었습니다. 이 모델은 GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama 또는 기타 벤더의 모델이 아닙니다.

계정을 어떻게 충전합니까?

암호화폐로만 충전할 수 있습니다: USDT(TRC20) 또는 USDC(Base). 최소 금액은 $10이며 최대 금액은 $500입니다. $50 이상의 충전 시 보너스 크레딧이 제공됩니다.

API는 스트리밍을 지원합니까?

네, API는 서버 전송 이벤트(SSE)를 통해 스트리밍을 지원합니다. 토큰 사용량은 스트림의 마지막 청크에 포함되므로 비용을 정확하게 추적할 수 있습니다.

속도 제한은 무엇입니까?

제한은 키당 분당 300개 요청, 키당 8개 동시 요청, 최대 요청 본문 크기 8 MB입니다. 이러한 제한은 공정한 사용과 일관된 성능을 보장합니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 다음 기본 URL을 변경하십시오. 이것이 전체 설정입니다.