VI ▾

Unfiltered AI Chatbot: Hướng dẫn nhanh: Tích hợp API LLM không kiểm duyệt

Tích hợp API LLM không kiểm duyệt của chúng tôi trong vài phút bằng các máy khách tương thích OpenAI tiêu chuẩn. Hướng dẫn này bao gồm xác thực, yêu cầu hoàn tất, truyền phát và sử dụng công cụ mà không có từ chối nội dung.

URL cơ bản & Xác thực

Để bắt đầu tích hợp, hãy trỏ ứng dụng của bạn đến URL cơ sở https://api.unfilteredaichatbot.cc/v1. API tuân theo cấu trúc chat-completions chuẩn của OpenAI, nghĩa là bạn có thể sử dụng các SDK hiện có bằng cách chỉ cần cập nhật URL cơ sở và cung cấp khóa API của bạn.

Xác thực dựa trên tiêu đề Authorization. Hãy bao gồm khóa riêng của bạn theo định dạng Bearer YOUR_API_KEY. Hệ thống xác thực khóa này trong mọi yêu cầu. Nếu khóa bị thiếu hoặc không hợp lệ, bạn sẽ nhận được lỗi 401. Mỗi tài khoản chỉ được giới hạn ở một khóa hoạt động; việc tạo khóa mới sẽ ngay lập tức vô hiệu hóa khóa trước đó. Điều này đảm bảo kiểm soát truy cập đơn giản mà không cần phân cấp quyền phức tạp.

Khóa API được hiển thị ngay sau khi đăng ký bằng Google hoặc email. Không cần số điện thoại và khóa vẫn có hiệu lực miễn là tín dụng trả trước của bạn đủ để chi trả việc sử dụng. Lỗi và từ chối không tiêu thụ tín dụng, vì vậy bạn có thể kiểm tra xác thực một cách an toàn.

Yêu cầu hoàn tất cơ bản

Gửi yêu cầu POST đến /v1/chat/completions với ID mô hình được đặt thành uncensored. Payload yêu cầu một mảng messages chứa lịch sử hội thoại của bạn. Endpoint này chấp nhận đầu vào văn bản và trả về đầu ra văn bản, tuân thủ nghiêm ngặt định dạng chat-completions.

Dưới đây là một ví dụ curl tiêu chuẩn minh họa một cuộc hội thoại hai lượt đơn giản. Mô hình sẽ phản hồi mà không chặn các chủ đề người lớn hoặc gây tranh cãi, miễn là chúng hợp pháp. Hãy đảm bảo bạn bao gồm trường model một cách rõ ràng để nhắm vào phiên bản không kiểm duyệt chính xác.

Đối với nhà phát triển Python, SDK OpenAI chính thức hoạt động ngay lập tức. Chỉ cần khởi tạo máy khách với URL cơ bản và khóa của bạn.

from openai import OpenAI

client = OpenAI(base_url="https://api.unfilteredaichatbot.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Và đối với người dùng Node.js, cấu trúc tương tự cũng được áp dụng. Khởi tạo máy khách và gọi chat.completions.create.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unfilteredaichatbot.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Phản hồi truyền phát

Bật chế độ truyền phát bằng cách đặt stream: true trong payload yêu cầu của bạn. API trả về luồng Sự kiện gửi bởi máy chủ (SSE), truyền phát token từng phần khi chúng được tạo ra. Điều này lý tưởng cho các giao diện người dùng thời gian thực nơi độ trễ là yếu tố quan trọng.

Phần cuối cùng của luồng chứa thống kê sử dụng đầy đủ, bao gồm số lượng token đầu vào và đầu ra. Bạn có thể sử dụng dữ liệu này để cập nhật giao diện người dùng hoặc theo dõi hóa đơn chính xác. Lưu ý rằng việc sử dụng token chỉ được báo cáo trong phần cuối cùng, vì vậy bạn phải phân tích cú pháp toàn bộ luồng để có số đếm chính xác.

Dưới đây là một ví dụ curl cho thấy cấu trúc yêu cầu truyền phát. Thay thế chỗ giữ chỗ bằng khóa thực tế và nội dung tin nhắn của bạn.

curl https://api.unfilteredaichatbot.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Truyền phát không ảnh hưởng đến giá hoặc giới hạn tốc độ; mỗi token được tạo vẫn tính vào việc sử dụng và giới hạn của bạn.

Gọi hàm

API hỗ trợ gọi hàm thông qua các tham số tools và tool_choice. Xác định các hàm của bạn trong mảng tools, và mô hình sẽ trả về JSON có cấu trúc khi thích hợp. Bạn có thể bắt buộc sử dụng công cụ bằng cách đặt tool_choice thành một hàm cụ thể hoặc auto để mô hình tự quyết định.

Tính năng này hoạt động trong cùng ngữ cảnh không kiểm duyệt, nghĩa là mô hình sẽ không từ chối gọi các công cụ liên quan đến chủ đề người lớn hoặc chuyên biệt trừ khi chúng vi phạm giới hạn nội dung cứng. Hãy sử dụng response_format được đặt thành {"type": "json_object"} nếu bạn cần đầu ra JSON nghiêm ngặt để phân tích cú pháp.

Gọi hàm là một phần của endpoint chat-completions tiêu chuẩn, vì vậy không cần cấu hình bổ sung ngoài tải trọng yêu cầu. Hãy đảm bảo các định nghĩa hàm của bạn tuân theo định dạng lược đồ OpenAI để tương thích.

Chế độ JSON

Đối với các ứng dụng yêu cầu dữ liệu có cấu trúc, hãy đặt response_format thành {"type": "json_object"}. Điều này hướng dẫn mô hình xuất ra JSON hợp lệ, giúp giảm lỗi phân tích cú pháp trong các hệ thống hạ lưu của bạn. Chế độ này hữu ích cho việc trích xuất dữ liệu, tạo cấu hình hoặc cung cấp năng lượng cho các quy trình tác nhân.

Chế độ JSON hoạt động cùng với gọi hàm nhưng cũng có thể được sử dụng để chuyển đổi văn bản sang JSON trực tiếp. Mô hình không kiểm duyệt, vì vậy nó sẽ tạo JSON ngay cả cho các cấu trúc dữ liệu phức tạp hoặc bất thường mà không từ chối do bộ lọc nội dung.

Hãy nhớ rằng chế độ JSON vẫn tính vào giới hạn token và hóa đơn của bạn. Hãy đảm bảo prompt của bạn xác định rõ cấu trúc JSON để cải thiện chất lượng đầu ra. Cửa sổ ngữ cảnh 100.000 token áp dụng cho tổng đầu vào và đầu ra kết hợp.

Giới hạn tốc độ & Lỗi

Mỗi khóa API được giới hạn ở 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời. Thân yêu cầu không được vượt quá 8 MB. Nếu bạn vượt quá giới hạn tốc độ, API sẽ trả về lỗi 429. Nếu tín dụng của bạn đã hết, bạn sẽ nhận được lỗi 402. Các lỗi xác thực dẫn đến lỗi 401.

Cửa sổ ngữ cảnh là 100.000 token tổng cộng, với tối đa 32.000 token đầu ra mỗi yêu cầu (2.048 nếu max_tokens chưa được đặt). Các lỗi và từ chối đều miễn phí, vì vậy bạn có thể kiểm tra giới hạn mà không tiêu tốn tín dụng. Tín dụng không bao giờ hết hạn, và số tiền trả trước được tính dựa trên mức sử dụng thực tế.

Để xử lý lỗi chi tiết, hãy kiểm tra các mã trạng thái. Lỗi 401 cho biết khóa không hợp lệ hoặc bị thiếu, trong khi lỗi 402 yêu cầu nạp tiền. Hãy sử dụng trang hỗ trợ để giải quyết các vấn đề về thanh toán. Không cần thẻ cho bản dùng thử, nhưng cần tiền điện tử để nạp tiền.

Truyền phát

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.unfilteredaichatbot.cc/v1
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Chế độ JSONresponse_format: {"type": "json_object"}
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Kích thước yêu cầutối đa 8 MB
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Làm cách nào để lấy khóa API?

Đăng ký bằng 'Tiếp tục với Google' hoặc email và mật khẩu trên trang Lấy khóa API. Khóa của bạn được hiển thị ngay sau khi đăng ký. Không cần số điện thoại và khóa hoạt động ngay lập tức.

Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ của mình?

API trả về lỗi 429. Mỗi khóa cho phép 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời. Các lỗi và từ chối không tính vào số dư tín dụng của bạn, nhưng chúng có tính vào giới hạn tốc độ.

Tín dụng dùng thử có thể gia hạn không?

Không, tín dụng dùng thử $0,50 là một lần cho mỗi người và có giá trị trong 7 ngày. Sau khi hết hạn hoặc sử dụng, bạn phải nạp tiền bằng tiền điện tử (USDT TRC20 hoặc USDC Base) để tiếp tục sử dụng API.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ thiết lập.

Lấy khóa API