nsfwllms.comDocs
NSFW LLM: Snelstartgids voor ongecensureerde LLM API
Kom in enkele minuten van start met onze ongecensureerde LLM API. Deze gids behandelt authenticatie, chatcompleties, streaming en tool calling met standaard OpenAI-compatible clients.
- per 1M input tokens
- $0.25
- Output tokens / 1M
- $1.00
- contextvenster van tokens
- 100,000
- gratis proeftegoed
- $0.50
- verzoeken per minuut
- 300
Basis-URL & Authenticatie
Onze API volgt de OpenAI-standaard, wat integratie eenvoudig maakt. Gebruik de basis-URL https://api.nsfwllms.com/v1 voor alle verzoeken. Authenticatie gebeurt via een Bearer-token in de Authorization header. Je kunt je API-sleutel genereren op de pagina API-sleutel ophalen met alleen een e-mailadres en wachtwoord. Er is geen telefoonnummer of creditcard nodig om te beginnen met het gratis proeftegoed.
Eerste Verzoek
Stuur een standaard chatcompletie-verzoek om de connectiviteit te testen. De modelidentifier is uncensored. Dit verzoek demonstreert de basis tekst-in, tekst-uit flow zonder speciale parameters.
curl https://api.nsfwllms.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Dit retourneert een standaard responsobject met de gegenereerde tekst. Als je een 401-fout krijgt, controleer dan je API-sleutel. Een 402 geeft aan dat je saldo aan prepaid tegoed onvoldoende is.
Python SDK Integratie
Gebruik de officiële openai Python-pakket om met de endpoint te communiceren. Stel de basis-URL in op onze servers en geef je API-sleutel op. Hiermee kun je bekende SDK-patronen gebruiken voor je ongecensureerde LLM-toepassingen.
from openai import OpenAI
client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
De client verwerkt serialisatie en retry-logica automatisch. Je kunt model="uncensored" doorgeven om zeker te zijn dat je het juiste ablatiemodel raakt.
Node SDK Gebruik
Voor JavaScript- of TypeScript-projecten initialiseer je de OpenAI-client met de aangepaste basis-URL. Deze aanpak werkt met elke OpenAI-compatible clientbibliotheek die aangepaste endpoints ondersteunt.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Zorg ervoor dat je een recente versie van de SDK gebruikt die de baseUrl configuratie ondersteunt. Dit zorgt voor compatibiliteit met onze streaming- en tool calling-functies.
Streaming Responsen (SSE)
Schakel streaming in door stream: true in je verzoek in te stellen. De API retourneert Server-Sent Events (SSE) die je incrementeel kunt verwerken. Dit vermindert de waargenomen latentie voor chatinterfaces.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Elke chunk bevat gedeeltelijke tekstdeltas. Plak deze deltas aan elkaar om de volledige respons te reconstrueren. Streaming werkt identiek aan het standaard OpenAI-protocol, dus bestaande stream parsers moeten zonder aanpassingen werken.
Rate Limits & Beperkingen
Elke API-sleutel is beperkt tot 300 verzoeken per minuut. De maximale grootte van het verzoeklichaam is 8 MB. Het contextvenster ondersteunt maximaal 100.000 tokens in totaal voor prompt en completion samen. Als je het rate limit overschrijdt, krijg je een 429-fout. Je kunt je API-sleutel op elk moment regenereren, waardoor de vorige sleutel onmiddellijk ongeldig wordt.
API-specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.nsfwllms.com/v1 |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| JSON-modus | response_format: {"type": "json_object"} |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Verzoekgrootte | tot 8 MB |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Wat gebeurt er als mijn prepaid tegoed op is?
Je krijgt een 402-foutmelding bij volgende verzoeken. Je kunt je account opwaarderen vanaf $10 met crypto (USDT of USDC). Bonus tegoed wordt automatisch toegevoegd in hogere niveaus.
Is het ongecensureerde model GPT-4?
Nee. De model-ID is <code>uncensored</code>. Het is een open-weight model getuned voor onbeperkte tekstgeneratie, draaiend op onze eigen GPU-servers. Het is geen GPT, Claude of een model van een andere leverancier.
Hoe ga ik om met streamingfouten?
Controleer de HTTP-statuscode van de responsstream. Als de stream voortijdig eindigt of een foutobject retourneert, controleer dan het <code>error</code>-veld voor details zoals rate limits of ongeldige parameters.