VI ▾
Lấy khóa API

nsfwllms.comTài liệu

API LLM NSFW: Hướng dẫn tích hợp nhanh API LLM không kiểm duyệt

Bắt đầu với API LLM không kiểm duyệt của chúng tôi trong vài phút. Hướng dẫn này bao gồm xác thực, hoàn thành trò chuyện, truyền phát và gọi công cụ bằng các máy khách tương thích OpenAI tiêu chuẩn.

trên mỗi 1 triệu token đầu vào
$0.25
Token đầu ra / 1 triệu
$1.00
cửa sổ ngữ cảnh token
100,000
tín dụng dùng thử
$0.50
yêu cầu mỗi phút
300

URL cơ bản & Xác thực

API của chúng tôi tuân theo tiêu chuẩn OpenAI, giúp việc tích hợp trở nên đơn giản. Sử dụng URL cơ bản https://api.nsfwllms.com/v1 cho mọi yêu cầu. Xác thực được xử lý qua token Bearer trong tiêu đề Authorization. Bạn có thể tạo khóa trên trang Lấy khóa API chỉ bằng email và mật khẩu. Không cần số điện thoại hay thẻ tín dụng để bắt đầu với tín dụng dùng thử miễn phí.

Yêu cầu đầu tiên

Gửi một yêu cầu hoàn thành trò chuyện tiêu chuẩn để kiểm tra kết nối. Định danh mô hình là uncensored. Yêu cầu này minh họa luồng văn bản vào, văn bản ra cơ bản mà không có tham số đặc biệt nào.

curl https://api.nsfwllms.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Điều này trả về một đối tượng phản hồi tiêu chuẩn chứa văn bản được tạo. Nếu bạn nhận lỗi 401, hãy xác minh khóa API của bạn. Lỗi 402 cho biết số dư tín dụng trả trước của bạn không đủ.

Tích hợp Python SDK

Sử dụng gói Python openai chính thức để tương tác với endpoint. Đặt URL cơ bản trỏ đến máy chủ của chúng tôi và cung cấp khóa API của bạn. Điều này cho phép bạn tận dụng các mẫu SDK quen thuộc cho các ứng dụng LLM không kiểm duyệt của mình.

from openai import OpenAI

client = OpenAI(base_url="https://api.nsfwllms.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Máy khách xử lý tự động việc tuần tự hóa và logic thử lại. Bạn có thể truyền model="uncensored" để đảm bảo bạn đang truy cập đúng mô hình đã được loại bỏ kiểm duyệt.

Sử dụng Node SDK

Đối với các dự án JavaScript hoặc TypeScript, hãy khởi tạo máy khách OpenAI với URL cơ bản tùy chỉnh. Cách tiếp cận này hoạt động với bất kỳ thư viện máy khách tương thích OpenAI nào hỗ trợ endpoint tùy chỉnh.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.nsfwllms.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Đảm bảo bạn đang sử dụng phiên bản SDK gần đây hỗ trợ cấu hình baseUrl. Điều này đảm bảo tương thích với các tính năng truyền phát và gọi công cụ của chúng tôi.

Phản hồi truyền phát (SSE)

Bật truyền phát bằng cách đặt stream: true trong yêu cầu của bạn. API trả về các Sự kiện gửi bởi máy chủ (SSE) mà bạn có thể xử lý theo từng phần. Điều này giảm độ trễ cảm nhận được cho các giao diện trò chuyện.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Mỗi phần chứa các delta văn bản một phần. Nối các delta này để tái tạo phản hồi đầy đủ. Truyền phát hoạt động giống hệt với giao thức OpenAI tiêu chuẩn, vì vậy các trình phân tích luồng hiện có sẽ hoạt động mà không cần sửa đổi.

Giới hạn tốc độ & Ràng buộc

Mỗi khóa API bị giới hạn 300 yêu cầu mỗi phút. Kích thước yêu cầu tối đa là 8 MB. Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token tổng cộng cho prompt và kết hợp hoàn thành. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận lỗi 429. Bạn có thể tạo lại khóa API bất cứ lúc nào, điều này sẽ thu hồi ngay lập tức khóa trước đó.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.nsfwllms.com/v1
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Chế độ JSONresponse_format: {"type": "json_object"}
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Điều gì xảy ra khi tín dụng trả trước của bạn hết?

Bạn sẽ nhận lỗi 402 cho các yêu cầu tiếp theo. Bạn có thể nạp tiền tài khoản từ $10 bằng tiền điện tử (USDT hoặc USDC). Tín dụng bonus được thêm tự động ở các gói cao hơn.

Mô hình không kiểm duyệt có phải GPT-4 không?

Không. ID mô hình là <code>uncensored</code>. Đây là mô hình trọng số mở được tinh chỉnh cho việc tạo văn bản không giới hạn, chạy trên máy chủ GPU của chúng tôi. Nó không phải GPT, Claude hay mô hình của nhà cung cấp khác.

Tôi xử lý lỗi truyền phát như thế nào?

Kiểm tra mã trạng thái HTTP của luồng phản hồi. Nếu luồng kết thúc sớm hoặc trả về đối tượng lỗi, hãy kiểm tra trường <code>error</code> để biết chi tiết như giới hạn tốc độ hoặc tham số không hợp lệ.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.

Lấy khóa API