PL ▾
Pobierz klucz API

nsfwllms.comDokumentacja

NSFW LLM: Szybki start API bez cenzury

Zacznij korzystać z naszego modelu LLM bez cenzury w kilka minut. Ten przewodnik obejmuje uwierzytelnianie, uzupełnienia czatu, strumieniowanie i wywoływanie funkcji przy użyciu standardowych klientów kompatybilnych z OpenAI.

za 1 mln tokenów wejściowych
$0.25
Tokeny wyjściowe / 1 mln
$1.00
okno kontekstu
100,000
darmowy kredyt próbny
$0.50
zapytania na minutę
300

URL bazowy i uwierzytelnianie

Nasz API podąża za standardem OpenAI, co ułatwia integrację. Użyj bazowego URL https://api.nsfwllms.com/v1 do wszystkich zapytań. Uwierzytelnianie odbywa się przez token Bearer w nagłówku Authorization. Możesz wygenerować klucz na stronie pobierania klucza API, używając tylko adresu e-mail i hasła. Nie jest wymagany numer telefonu ani karta kredytowa, aby rozpocząć korzystanie z darmowego kredytu próbnego.

Pierwsze zapytanie

Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować łączność. Identyfikator modelu to uncensored. To zapytanie pokazuje podstawowy przepływ tekst-wejściowy, tekst-wyjściowy bez żadnych dodatkowych parametrów.

curl https://api.nsfwllms.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Zwraca to standardowy obiekt odpowiedzi z wygenerowanym tekstem. Jeśli otrzymasz błąd 401, zweryfikuj klucz API. Błąd 402 oznacza, że saldo przedpłaconego kredytu jest niewystarczające.

Integracja z Python SDK

Użyj oficjalnego pakietu openai w Pythonie do interakcji z endpointem. Ustaw bazowy URL, aby wskazywał nasze serwery, i podaj swój klucz API. Pozwala to wykorzystać znane wzorce SDK w aplikacjach LLM bez cenzury.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Klient automatycznie obsługuje serializację i logikę ponawiania. Możesz przekazać model="uncensored", aby upewnić się, że trafiasz do właściwego modelu po ablacji.

Użycie Node SDK

W projektach JavaScript lub TypeScript zainicjuj klienta OpenAI z niestandardowym bazowym URL. To podejście działa z każdą biblioteką klienta kompatybilną z OpenAI, która obsługuje niestandardowe endpointy.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Upewnij się, że używasz najnowszej wersji SDK, która obsługuje konfigurację baseUrl. Zapewnia to kompatybilność z naszymi funkcjami strumieniowania i wywoływania funkcji.

Strumieniowanie odpowiedzi (SSE)

Włącz strumieniowanie, ustawiając stream: true w zapytaniu. API zwraca zdarzenia wysyłane przez serwer (SSE), które możesz przetwarzać inkrementalnie. Zmniejsza to postrzeganą latencję w interfejsach czatu.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Każdy fragment zawiera częściowe delta tekstu. Połącz te delty, aby odtworzyć pełną odpowiedź. Strumieniowanie działa identycznie jak w standardowym protokole OpenAI, więc istniejące parserów strumienia powinny działać bez modyfikacji.

Limity zapytań i ograniczenia

Każdy klucz API jest ograniczony do 300 zapytań na minutę. Maksymalny rozmiar ciała zapytania to 8 MB. Okno kontekstu obsługuje do 100 000 tokenów łącznie dla promptu i uzupełnienia. Jeśli przekroczysz limit zapytań, otrzymasz błąd 429. Możesz wygenerować ponownie swój klucz API w dowolnym momencie, co natychmiast unieważnia poprzedni klucz.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
UwierzytelnianieAuthorization: Bearer YOUR_KEY
ID modeluuncensored
EndpointyPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllms.com/v1
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Tryb JSONresponse_format: {"type": "json_object"}
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Rozmiar zapytaniado 8 MB
Limit zapytań300 zapytań na minutę na klucz
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Bonus+5% od $50, +10% od $100
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Co się stanie, gdy skończy się przedpłacony kredyt?

Otrzymasz błąd 402 przy kolejnych zapytaniach. Możesz doładować konto od $10 kryptowalutą (USDT lub USDC). Bonusowe kredyty dodawane są automatycznie na wyższych poziomach.

Czy model bez cenzury to GPT-4?

Nie. ID modelu to <code>uncensored</code>. To model o otwartych wagach dostosowany do nieograniczonej generacji tekstu, działający na naszych serwerach GPU. Nie jest to GPT, Claude ani model innego dostawcy.

Jak radzić sobie z błędami strumieniowania?

Sprawdź kod statusu HTTP strumienia odpowiedzi. Jeśli strumień zakończy się przedwcześnie lub zwróci obiekt błędu, sprawdź pole <code>error</code> pod kątem limitów zapytań lub nieprawidłowych parametrów.

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień URL bazowy. To cała konfiguracja.

Pobierz klucz API