DE ▾
API-Schlüssel erhalten

nsfwllms.comDokumentation

NSFW LLM: Unzensierte LLM API-Schnellstart

Starte in Minuten mit unserer unzensierten LLM API. Dieser Leitfaden behandelt Authentifizierung, Chat-Vervollständigungen, Streaming und Function Calling mit standardmäßigen OpenAI-kompatiblen Clients.

pro 1M Input-Token
$0.25
Output-Token / 1M
$1.00
Token-Kontextfenster
100,000
Testguthaben
$0.50
Anfragen pro Minute
300

Basis-URL & Authentifizierung

Unsere API folgt dem OpenAI-Standard, was die Integration einfach macht. Verwende die Basis-URL https://api.nsfwllms.com/v1 für alle Anfragen. Die Authentifizierung erfolgt über einen Bearer-Token im Authorization-Header. Du kannst deinen Schlüssel auf der Seite API-Schlüssel erstellen, indem du nur E-Mail und Passwort angibst. Keine Telefonnummer oder Kreditkarte erforderlich, um mit dem kostenlosen Testguthaben zu starten.

Erste Anfrage

Sende eine standardmäßige Chat-Vervollständigungsanfrage, um die Konnektivität zu testen. Die Modellkennung ist uncensored. Diese Anfrage veranschaulicht den grundlegenden Text-ein, Text-aus-Ablauf ohne spezielle Parameter.

curl https://api.nsfwllms.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Dies gibt ein standardmäßiges Antwortobjekt zurück, das den generierten Text enthält. Wenn du einen 401-Fehler erhältst, überprüfe deinen API-Schlüssel. Ein 402-Fehler zeigt an, dass dein Prepaid-Guthaben nicht ausreicht.

Python SDK-Integration

Verwende das offizielle openai Python-Paket, um mit dem Endpunkt zu interagieren. Lege die Basis-URL so fest, dass sie auf unsere Server verweist, und gib deinen API-Schlüssel an. So kannst du vertraute SDK-Muster für deine unzensierten LLM-Anwendungen nutzen.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Der Client verarbeitet die Serialisierung und Wiederholungslogik automatisch. Du kannst model="uncensored" übergeben, um sicherzustellen, dass du das richtige, zensurfreie Modell ansprichst.

Node SDK-Nutzung

Für JavaScript- oder TypeScript-Projekte initialisiere den OpenAI-Client mit der benutzerdefinierten Basis-URL. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek, die benutzerdefinierte Endpunkte unterstützt.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Stelle sicher, dass du eine aktuelle Version des SDK verwendest, die die baseUrl-Konfiguration unterstützt. Dies gewährleistet die Kompatibilität mit unseren Streaming- und Function Calling-Funktionen.

Streaming-Antworten (SSE)

Aktiviere das Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) zurück, die du inkrementell verarbeiten kannst. Dies reduziert die wahrgenommene Latenz für Chat-Schnittstellen.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Jeder Chunk enthält partielle Textdeltas. Verbinde diese Deltas, um die vollständige Antwort wiederherzustellen. Das Streaming funktioniert identisch zum Standard-OpenAI-Protokoll, daher sollten vorhandene Stream-Parser ohne Änderungen funktionieren.

Ratenlimits & Einschränkungen

Jeder API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster unterstützt insgesamt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen API-Schlüssel jederzeit neu generieren, wodurch der vorherige Schlüssel sofort ungültig wird.

Funktionen und Limits

Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.

MerkmalWert
API-FormatOpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern
AuthentifizierungAuthorization: Bearer YOUR_KEY
Modell-IDuncensored
EndpunktePOST /v1/chat/completions · GET /v1/models
Base-URLhttps://api.nsfwllms.com/v1
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kontextfenster100.000 Tokens (Eingabe + Ausgabe)
Streamingja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung
JSON-Modusresponse_format: {"type": "json_object"}
Max. Ausgabebis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit)
Function Callingja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool
Antwort-HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Parallelität8 gleichzeitige Anfragen pro Schlüssel
Anfragegrößebis 8 MB
Ratenlimit300 Anfragen pro Minute und Schlüssel
AbrechnungPrepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos
Testguthaben$0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung
Gültigkeitbezahltes Guthaben verfällt nie, kein Abo
Preis$0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens
AufladenUSDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500
Bonus+5 % ab $50, +10 % ab $100
InhalteInhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt
AnmeldungGoogle oder E-Mail und Passwort
Schlüsselein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten

Fehler und Lösungen

Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.

CodeTypBedeutung
400bad_requestungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang
401missing_key · invalid_key · key_revokedSchlüssel fehlt, ist falsch oder wurde ersetzt
402no_creditkein Guthaben – aufladen, dann geht es sofort weiter
403content_blockedsexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet
404not_foundunbekannter Endpunkt
413request_too_largeAnfrage größer als 8 MB
429rate_limited · concurrencyüber 300/Min. oder 8 parallel – kurz warten
503upstream_busyModell ausgelastet – in Sekunden erneut versuchen

Fragen und Antworten

Was passiert, wenn mein Prepaid-Guthaben aufgebraucht ist?

Du erhältst bei nachfolgenden Anfragen einen 402-Fehler. Du kannst dein Konto ab $10 über Krypto (USDT oder USDC) aufladen. Bonusguthaben werden in höheren Stufen automatisch hinzugefügt.

Ist das unzensierte Modell GPT-4?

Nein. Die Modell-ID ist <code>uncensored</code>. Es ist ein Open-Weight-Modell, das für uneingeschränkte Textgenerierung optimiert ist und auf unseren eigenen GPU-Servern läuft. Es ist kein GPT-, Claude- oder ein anderes Modell eines anderen Anbieters.

Wie gehe ich mit Streaming-Fehlern um?

Prüfe den HTTP-Statuscode des Antwort-Streams. Wenn der Stream vorzeitig endet oder ein Fehlerobjekt zurückgibt, prüfe das <code>error</code>-Feld auf Details wie Ratenlimits oder ungültige Parameter.

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.

API-Schlüssel erhalten