nsfwllms.comDokumentation
NSFW LLM: Unzensierte LLM API-Schnellstart
Starte in Minuten mit unserer unzensierten LLM API. Dieser Leitfaden behandelt Authentifizierung, Chat-Vervollständigungen, Streaming und Function Calling mit standardmäßigen OpenAI-kompatiblen Clients.
- pro 1M Input-Token
- $0.25
- Output-Token / 1M
- $1.00
- Token-Kontextfenster
- 100,000
- Testguthaben
- $0.50
- Anfragen pro Minute
- 300
Basis-URL & Authentifizierung
Unsere API folgt dem OpenAI-Standard, was die Integration einfach macht. Verwende die Basis-URL https://api.nsfwllms.com/v1 für alle Anfragen. Die Authentifizierung erfolgt über einen Bearer-Token im Authorization-Header. Du kannst deinen Schlüssel auf der Seite API-Schlüssel erstellen, indem du nur E-Mail und Passwort angibst. Keine Telefonnummer oder Kreditkarte erforderlich, um mit dem kostenlosen Testguthaben zu starten.
Erste Anfrage
Sende eine standardmäßige Chat-Vervollständigungsanfrage, um die Konnektivität zu testen. Die Modellkennung ist uncensored. Diese Anfrage veranschaulicht den grundlegenden Text-ein, Text-aus-Ablauf ohne spezielle Parameter.
curl https://api.nsfwllms.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Dies gibt ein standardmäßiges Antwortobjekt zurück, das den generierten Text enthält. Wenn du einen 401-Fehler erhältst, überprüfe deinen API-Schlüssel. Ein 402-Fehler zeigt an, dass dein Prepaid-Guthaben nicht ausreicht.
Python SDK-Integration
Verwende das offizielle openai Python-Paket, um mit dem Endpunkt zu interagieren. Lege die Basis-URL so fest, dass sie auf unsere Server verweist, und gib deinen API-Schlüssel an. So kannst du vertraute SDK-Muster für deine unzensierten LLM-Anwendungen nutzen.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Der Client verarbeitet die Serialisierung und Wiederholungslogik automatisch. Du kannst model="uncensored" übergeben, um sicherzustellen, dass du das richtige, zensurfreie Modell ansprichst.
Node SDK-Nutzung
Für JavaScript- oder TypeScript-Projekte initialisiere den OpenAI-Client mit der benutzerdefinierten Basis-URL. Dieser Ansatz funktioniert mit jeder OpenAI-kompatiblen Client-Bibliothek, die benutzerdefinierte Endpunkte unterstützt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Stelle sicher, dass du eine aktuelle Version des SDK verwendest, die die baseUrl-Konfiguration unterstützt. Dies gewährleistet die Kompatibilität mit unseren Streaming- und Function Calling-Funktionen.
Streaming-Antworten (SSE)
Aktiviere das Streaming, indem du stream: true in deiner Anfrage festlegst. Die API gibt Server-Sent Events (SSE) zurück, die du inkrementell verarbeiten kannst. Dies reduziert die wahrgenommene Latenz für Chat-Schnittstellen.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Jeder Chunk enthält partielle Textdeltas. Verbinde diese Deltas, um die vollständige Antwort wiederherzustellen. Das Streaming funktioniert identisch zum Standard-OpenAI-Protokoll, daher sollten vorhandene Stream-Parser ohne Änderungen funktionieren.
Ratenlimits & Einschränkungen
Jeder API-Schlüssel ist auf 300 Anfragen pro Minute begrenzt. Die maximale Größe des Anfragekörpers beträgt 8 MB. Das Kontextfenster unterstützt insgesamt bis zu 100.000 Token für Prompt und Vervollständigung zusammen. Wenn du das Ratenlimit überschreitest, erhältst du einen 429-Fehler. Du kannst deinen API-Schlüssel jederzeit neu generieren, wodurch der vorherige Schlüssel sofort ungültig wird.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.nsfwllms.com/v1 |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| JSON-Modus | response_format: {"type": "json_object"} |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Anfragegröße | bis 8 MB |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehler und Lösungen
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Fragen und Antworten
Was passiert, wenn mein Prepaid-Guthaben aufgebraucht ist?
Du erhältst bei nachfolgenden Anfragen einen 402-Fehler. Du kannst dein Konto ab $10 über Krypto (USDT oder USDC) aufladen. Bonusguthaben werden in höheren Stufen automatisch hinzugefügt.
Ist das unzensierte Modell GPT-4?
Nein. Die Modell-ID ist <code>uncensored</code>. Es ist ein Open-Weight-Modell, das für uneingeschränkte Textgenerierung optimiert ist und auf unseren eigenen GPU-Servern läuft. Es ist kein GPT-, Claude- oder ein anderes Modell eines anderen Anbieters.
Wie gehe ich mit Streaming-Fehlern um?
Prüfe den HTTP-Statuscode des Antwort-Streams. Wenn der Stream vorzeitig endet oder ein Fehlerobjekt zurückgibt, prüfe das <code>error</code>-Feld auf Details wie Ratenlimits oder ungültige Parameter.