KO ▾
API 키 받기

nsfwllms.com문서

NSFW LLM: 무검열 LLM API 시작하기

무검열 LLM API로 몇 분 안에 시작하세요. 이 가이드는 표준 OpenAI 호환 클라이언트를 사용한 인증, 채팅 완성, 스트리밍 및 도구 호출을 다룹니다.

입력 토큰 100만 개당
$0.25
출력 토큰 / 1M
$1.00
토큰 컨텍스트 창
100,000
무료 체험 크레딧
$0.50
분당 요청 수
300

베이스 URL 및 인증

당사의 API는 OpenAI 표준을 따르므로 통합이 간단합니다. 모든 요청에 베이스 URL https://api.nsfwllms.com/v1을 사용하세요. 인증은 Authorization 헤더의 Bearer 토큰으로 처리됩니다. 이메일과 비밀번호만으로 API 키 생성 페이지에서 키를 생성할 수 있습니다. 무료 체험 크레딧으로 시작하려면 전화번호나 신용카드가 필요하지 않습니다.

첫 번째 요청

연결성을 테스트하기 위해 표준 채팅 완성 요청을 보내세요. 모델 식별자는 uncensored입니다. 이 요청은 특수 매개변수 없이 기본 텍스트 입력-출력 흐름을 보여줍니다.

curl https://api.nsfwllms.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

이 요청은 생성된 텍스트를 포함한 표준 응답 객체를 반환합니다. 401 오류가 발생하면 API 키를 확인하세요. 402 오류는 선불 크레딧 잔액이 부족함을 나타냅니다.

Python SDK 통합

엔드포인트와 상호 작용하려면 공식 openai Python 패키지를 사용하세요. 베이스 URL을 당사 서버를 가리키도록 설정하고 API 키를 제공하세요. 이렇게 하면 무검열 LLM 애플리케이션에 익숙한 SDK 패턴을 활용할 수 있습니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

클라이언트는 직렬화 및 재시도 로직을 자동으로 처리합니다. 올바른 무검열 모델에 접근하려면 model="uncensored"를 전달하세요.

Node SDK 사용법

JavaScript 또는 TypeScript 프로젝트의 경우 커스텀 베이스 URL로 OpenAI 클라이언트를 초기화하세요. 이 방법은 커스텀 엔드포인트를 지원하는 모든 OpenAI 호환 클라이언트 라이브러리에서 작동합니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

baseUrl 구성을 지원하는 최신 버전의 SDK를 사용하고 있는지 확인하세요. 이렇게 하면 스트리밍 및 도구 호출 기능과의 호환성이 보장됩니다.

스트리밍 응답 (SSE)

요청에 stream: true을 설정하여 스트리밍을 활성화하세요. API는 증분 처리할 수 있는 서버 전송 이벤트(SSE)를 반환합니다. 이는 채팅 인터페이스의 지각된 지연 시간을 줄여줍니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

각 청크에는 부분 텍스트 델타가 포함됩니다. 이러한 델타를 연결하여 전체 응답을 복원하세요. 스트리밍은 표준 OpenAI 프로토콜과 동일하게 작동하므로 기존 스트림 파서는 수정 없이 작동해야 합니다.

속도 제한 및 제약 사항

각 API 키는 분당 300개의 요청으로 제한됩니다. 최대 요청 본문 크기는 8 MB입니다. 컨텍스트 창은 프롬프트와 완성을 합쳐 최대 100,000개의 토큰을 지원합니다. 속도 제한을 초과하면 429 오류가 발생합니다. 언제든지 API 키를 재생성할 수 있으며, 이는 이전 키를 즉시 무효화합니다.

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
인증Authorization: Bearer YOUR_KEY
모델 IDuncensored
엔드포인트POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllms.com/v1
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
컨텍스트 창100,000 토큰 (입력 + 출력)
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
JSON 모드response_format: {"type": "json_object"}
최대 출력100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
동시 요청키당 동시 8개
요청 크기최대 8 MB
속도 제한키당 분당 300회
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
유효기간유료 크레딧은 만료되지 않으며 구독 없음
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
보너스$50 이상 +5%, $100 이상 +10%
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
로그인Google 또는 이메일과 비밀번호
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

선불 크레딧이 고갈되면 어떻게 되나요?

후속 요청에서 402 오류가 발생합니다. 암호화폐(USDT 또는 USDC)로 $10부터 계정을 충전할 수 있습니다. 상위 티어에서는 보너스 크레딧이 자동으로 추가됩니다.

무검열 모델이 GPT-4인가요?

아닙니다. 모델 ID는 <code>uncensored</code>입니다. 이 모델은 제한 없는 텍스트 생성을 위해 튜닝된 오픈 웨이트 모델로, 자체 GPU 서버에서 실행됩니다. GPT, Claude 또는 기타 벤더의 모델이 아닙니다.

스트리밍 오류를 어떻게 처리하나요?

응답 스트림의 HTTP 상태 코드를 확인하세요. 스트림이 조기에 종료되거나 오류 객체를 반환하는 경우, 속도 제한 또는 잘못된 매개변수와 같은 세부 정보를 위해 <code>error</code> 필드를 검사하세요.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 베이스 URL을 변경하세요. 설정은 이것으로 끝입니다.

API 키 받기