- API dùng endpoint tương thích OpenAI chuẩn tại https://api.uncensoredai.top/v1, yêu cầu không thay đổi mã cho các client hiện có.
- Giá cả minh bạch ở mức $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra, không có gói đăng ký hàng tháng.
- Thanh toán xử lý độc quyền qua crypto (USDT hoặc USDC), cho phép nạp tiền ngay lập tức mà không cần thẻ tín dụng.
- Mô hình hỗ trợ streaming, chế độ JSON và gọi hàm trong cửa sổ ngữ cảnh 100k, nhưng không hỗ trợ embeddings hoặc vision.
Tại sao chọn API Uncensored AI?
Hầu hết các nhà cung cấp LLM thương mại áp dụng bộ lọc an toàn nghiêm ngặt có thể chặn văn bản sáng tạo, nhập vai hoặc phân tích kỹ thuật về các chủ đề gây tranh cãi. API ai không kiểm duyệt loại bỏ các từ chối tùy ý này, cho phép mô hình trả lời dựa trên dữ liệu huấn luyện thay vì lớp chính sách nội dung. Điều này đặc biệt hữu ích cho các nhà phát triển xây dựng ứng dụng yêu cầu đầu ra thô từ mô hình mà không cần bộ lọc xử lý sau.
Khác với các bộ tổng hợp mô hình định tuyến yêu cầu đến nhiều nhà cung cấp, dịch vụ này cung cấp một mô hình chuyên dụng duy nhất. Điều này loại bỏ sự không ổn định của logic định tuyến và đảm bảo hành vi nhất quán. Mô hình là biến thể trọng số mở được tinh chỉnh để giảm thiểu từ chối cho nội dung người lớn hợp pháp, nghiên cứu bảo mật và truyện hư cấu.
Tuy nhiên, 'không kiểm duyệt' không có nghĩa là không giới hạn. Dịch vụ vẫn áp dụng giới hạn cứng về nội dung tình dục liên quan đến trẻ em. Đối với hầu hết các trường hợp sử dụng khác, bao gồm chủ đề trưởng thành hoặc logic không truyền thống, mô hình sẽ tạo phản hồi. Cách tiếp cận này lý tưởng cho nhà phát triển muốn kiểm soát hoàn toàn chiến lược nội dung ứng dụng mà không dựa vào khẩu vị của nhà cung cấp.
Thiết lập môi trường của bạn
Quá trình tích hợp bắt đầu bằng cách trỏ SDK tương thích OpenAI của bạn vào URL cơ sở đúng. Endpoint được lưu trữ tại https://api.uncensoredai.top/v1. Điều này có nghĩa là bạn có thể sử dụng các thư viện Python hoặc Node.js chính thức của OpenAI mà không cần viết lại logic client. Bạn chỉ cần cập nhật tham số base_url và cung cấp khóa API của bạn.
Dịch vụ hỗ trợ cửa sổ ngữ cảnh 100.000 token, lớn hơn đáng kể so với nhiều gói tiêu chuẩn khác. Điều này cho phép xử lý lịch sử prompt dài hoặc tài liệu lớn. Lưu ý rằng đầu ra tối đa cho mỗi yêu cầu là 32.000 token. Nếu bạn không chỉ định max_tokens, giá trị mặc định là 2.048 token.
- Tương thích SDK: Hoạt động với bất kỳ client nào hỗ trợ giao thức Chat Completions của OpenAI.
- Cửa sổ ngữ cảnh: 100k token tổng cộng (đầu vào + đầu ra).
- Đầu ra tối đa: 32k token mỗi yêu cầu.
Đảm bảo các biến môi trường được đặt đúng để tránh vấn đề độ trễ. API được thiết kế cho tích hợp trực tiếp qua mã, không có giao diện web để học. Bạn tương tác với nó hoàn toàn qua các yêu cầu HTTP.
Xác thực và Headers
Xác thực được xử lý qua tiêu chuẩn Authorization header. Bạn sẽ nhận được một khóa API duy nhất khi đăng ký. Không giống như các dịch vụ phát hành nhiều khóa cho mỗi tài khoản, nền tảng này áp dụng một khóa hoạt động duy nhất cho mỗi tài khoản. Nếu bạn tạo khóa mới, khóa trước đó sẽ bị vô hiệu hóa ngay lập tức.
Để xác thực một yêu cầu, hãy bao gồm header: Authorization: Bearer YOUR_API_KEY. Dịch vụ cũng cung cấp endpoint GET /v1/models, trả về thông tin mô hình có sẵn, bao gồm ID mô hình uncensored. Điều này hữu ích để xác minh kết nối trước khi gửi các payload phức tạp.
Giới hạn tốc độ:
- 300 yêu cầu mỗi phút mỗi khóa.
- 8 yêu cầu đồng thời cùng lúc mỗi khóa.
- Kích thước body yêu cầu tối đa 8 MB.
Các giới hạn này khá rộng rãi cho hầu hết ứng dụng nhưng nên được tôn trọng để tránh lỗi 429. Vì không có gói đăng ký, các giới hạn này áp dụng đồng đều cho tất cả người dùng bất kể số dư tín dụng.
Gửi yêu cầu Completion đầu tiên của bạn
Một yêu cầu cơ bản tuân theo định dạng Chat Completions tiêu chuẩn. Bạn gửi một payload JSON với model được đặt thành uncensored và mảng messages của bạn. Dịch vụ trả về phản hồi văn bản. Không có endpoint embedding, vision hay audio—đây là một API văn bản thuần túy.
Yêu cầu ví dụ:
Ví dụ dưới đây minh họa một lệnh hoàn thành trò chuyện tiêu chuẩn. Thay thế YOUR_API_KEY bằng khóa thực tế của bạn.
curl https://api.uncensoredai.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Phản hồi sẽ chứa văn bản được tạo trong choices[0].message.content. Lỗi được trả về theo định dạng HTTP tiêu chuẩn, cho phép bạn xử lý việc thử lại hoặc thất bại một cách khéo léo. Lưu ý rằng lỗi không tiêu tốn tín dụng của bạn, vì vậy bạn có thể kiểm tra tự do.
Đối với các nhà phát triển quen thuộc với OpenAI, trải nghiệm là giống hệt nhau. Sự khác biệt duy nhất là URL cơ sở và hành vi của mô hình liên quan đến bộ lọc nội dung. Sự nhất quán này giảm đường cong học hỏi cho các nhóm đã sử dụng các công cụ tương thích với OpenAI.
Xử lý phản hồi truyền phát
Truyền phát (streaming) được hỗ trợ qua Server-Sent Events (SSE). Điều này cho phép bạn nhận token khi chúng được tạo, mang lại trải nghiệm người dùng tốt hơn cho các phản hồi dài. Endpoint truyền phát giống với endpoint không truyền phát; bạn chỉ cần đặt stream: true trong yêu cầu của mình.
Lợi ích của truyền phát:
- Giảm độ trễ cảm nhận cho người dùng.
- Khả năng hiển thị kết quả từng phần theo thời gian thực.
- Sử dụng bộ nhớ hiệu quả vì token được xử lý tăng dần.
Phần dữ liệu cuối cùng của phản hồi truyền phát bao gồm thống kê sử dụng token. Điều này rất quan trọng cho độ chính xác của việc tính phí, vì bạn có thể theo dõi chính xác số token đã được tiêu thụ. Lỗi trong quá trình truyền phát có thể dẫn đến phản hồi một phần, vì vậy máy khách của bạn nên xử lý các phần dữ liệu không đầy đủ một cách khéo léo.
Ví dụ mã:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Đảm bảo thư viện client của bạn xử lý stream SSE đúng cách. Hầu hết các SDK hiện đại trừu tượng hóa điều này, nhưng hiểu giao thức nền tảng giúp gỡ lỗi các vấn đề kết nối hoặc lỗi phân tích cú pháp.
Tính năng nâng cao: Chế độ JSON và Tools
API hỗ trợ đầu ra có cấu trúc thông qua response_format được đặt thành {"type": "json_object"}. Điều này buộc mô hình trả về JSON hợp lệ, rất cần thiết để tích hợp với các hệ thống phần mềm khác. Tính năng này đặc biệt hữu ích cho việc trích xuất dữ liệu hoặc tạo tệp cấu hình.
Gọi hàm (function calling) cũng được hỗ trợ. Bạn có thể xác định các công cụ trong yêu cầu của mình, và mô hình sẽ trả về các lệnh gọi công cụ trong phản hồi của nó. Điều này cho phép các quy trình làm việc phức tạp nơi LLM có thể kích hoạt các hành động bên ngoài. Tham số tool_choice cho phép bạn buộc các công cụ cụ thể hoặc để mô hình tự quyết định.
Tham số chính:
temperature: Kiểm soát độ ngẫu nhiên.top_p: Kiểm soát sự đa dạng.stop: Xác định các chuỗi dừng.seed: Để có phản hồi xác định.
Các tính năng này làm cho API phù hợp cho các ứng dụng sản xuất yêu cầu dữ liệu có cấu trúc đáng tin cậy. Mặc dù mô hình không kiểm duyệt, nó vẫn tuân thủ các ràng buộc cấu trúc khi được yêu cầu. Sự cân bằng giữa tự do và cấu trúc này là lợi thế chính cho nhà phát triển xây dựng các agent phức tạp.
Theo dõi mức sử dụng và giới hạn
Mức sử dụng được theo dõi theo từng khóa API. Bảng điều khiển hiển thị số dư tín dụng hiện tại và lịch sử yêu cầu gần đây. Vì việc tính phí dựa trên mức sử dụng token thực tế, bạn có thể theo dõi chi phí theo thời gian thực. Dịch vụ không tính phí cho các lỗi hoặc từ chối, điều này có thể giúp tiết kiệm chi phí trong các giai đoạn thử nghiệm.
Số liệu sử dụng:
- Token đầu vào: Tính phí $0,25 cho mỗi 1 triệu token.
- Token đầu ra: Tính phí $1,00 cho mỗi 1 triệu token.
- Lỗi: Miễn phí.
Bạn có thể thiết lập cảnh báo nếu thư viện khách hàng của bạn hỗ trợ, nhưng việc theo dõi chính được thực hiện thông qua bảng điều khiển tài khoản. Giới hạn 300 yêu cầu mỗi phút đảm bảo mức sử dụng công bằng cho tất cả người dùng. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được mã trạng thái 429.
Đối với các ứng dụng có khối lượng lớn, bạn nên triển khai cơ chế backoff theo cấp số nhân cho các lần thử lại. Dịch vụ được thiết kế để đáng tin cậy, nhưng các sự cố mạng hoặc giới hạn tốc độ có thể xảy ra. Theo dõi mức sử dụng token giúp bạn lập ngân sách hiệu quả, đặc biệt vì tín dụng không bao giờ hết hạn.
Quản lý tín dụng qua tiền điện tử
Thanh toán được xử lý độc quyền thông qua tiền điện tử. Bạn có thể nạp tiền vào tài khoản của mình bằng USDT (TRC20) hoặc USDC (Base). Số tiền nạp tối thiểu là $10 và tối đa là $500. Không có gói đăng ký hàng tháng hoặc phí định kỳ.
Tín dụng bổ sung:
- Nạp $50: +5% tín dụng bổ sung.
- Nạp $100: +10% tín dụng bổ sung.
Tín dụng không bao giờ hết hạn, vì vậy bạn có thể nạp một lần và sử dụng chúng theo thời gian. Điều này rất lý tưởng cho các dự án dài hạn nơi mức tiêu thụ token thay đổi. Việc không có phí xử lý thẻ tín dụng khiến tiền điện tử trở thành tùy chọn tiết kiệm chi phí cho các nhà phát triển đã nắm giữ các stablecoin.
Quy trình thanh toán:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Để thanh toán, hãy tạo địa chỉ gửi tiền từ bảng điều khiển của bạn, gửi tiền điện tử và tín dụng sẽ được thêm vào tự động. Hoàn tiền cho tín dụng không được cung cấp, nhưng các lỗi như tính phí trùng lặp sẽ được khắc phục thông qua trang Hỗ trợ. Mô hình này giảm bớt rào cản cho các nhà phát triển toàn cầu có thể gặp hạn chế về ngân hàng.
Hỏi đáp
API này có phù hợp cho sản xuất không?
Có, API được thiết kế cho sản xuất với hỗ trợ truyền phát, chế độ JSON và công cụ. API có giới hạn 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời, điều này đủ cho hầu hết các ứng dụng. Tuy nhiên, API không cung cấp SLA hoặc cam kết thời gian hoạt động, vì vậy bạn nên triển khai các lần thử lại trong khách hàng của mình.
Điều gì xảy ra nếu tôi thực hiện một yêu cầu bị từ chối?
Nếu một yêu cầu bị từ chối do giới hạn nội dung cứng (nội dung tình dục liên quan đến trẻ vị thành niên), bạn sẽ không bị tính phí cho yêu cầu đó. Các từ chối khác, chẳng hạn như những từ chối dựa trên phán đoán của chính mô hình, có thể vẫn phát sinh chi phí token. Lỗi trong quá trình xử lý luôn miễn phí.
Tôi có thể sử dụng API này với SDK OpenAI chính thức không?
Có, API tương thích hoàn toàn với OpenAI. Bạn chỉ cần thay đổi URL cơ sở thành https://api.uncensoredai.top/v1 và cập nhật khóa API của mình. ID mô hình là 'uncensored'. Tất cả các tham số khác như temperature, top_p và công cụ hoạt động như được tài liệu hóa bởi OpenAI.
Làm thế nào để bắt đầu với bản dùng thử?
Mọi tài khoản mới đều nhận được $0,50 tín dụng dùng thử có hiệu lực trong 7 ngày. Bạn có thể đăng ký bằng Google hoặc địa chỉ email mà không cần thẻ tín dụng. Điều này cho phép bạn kiểm tra độ trễ, chất lượng phản hồi và các tính năng truyền phát của API trước khi mua tín dụng.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.