Base URL e Autenticação
Para começar a usar a uncensored AI API, aponte seu cliente para a base URL: https://api.uncensoredai.top/v1. Este endpoint é totalmente compatível com os SDKs da OpenAI, o que significa que você só precisa atualizar a base URL e fornecer sua chave de API. Autentique-se passando sua uncensored AI API key no cabeçalho Authorization como um token Bearer.
curl https://api.uncensoredai.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Sua chave é gerada imediatamente após o cadastro via Google ou e-mail. Mantenha-a segura; ela concede acesso total ao seu crédito pré-pago. Se você perder sua chave, gere uma nova, que substituirá a chave ativa antiga da sua conta.
Endpoint /v1/chat/completions
O núcleo da API LLM sem censura é o endpoint POST /v1/chat/completions. Envie um payload JSON contendo seu prompt do sistema, mensagens do usuário e os parâmetros desejados. O ID do modelo a ser usado é uncensored. Este modelo dedicado é ajustado para responder sem recusas de conteúdo para uso adulto legal, tornando-o ideal para geração de texto criativa ou sem restrições.
Ao contrário de agregadores, não roteamos entre vários fornecedores. Você obtém comportamento consistente de um único modelo de pesos abertos. O endpoint aceita campos padrão como model, messages e temperature. Erros e recusas não consomem seu crédito, garantindo que você pague apenas pelo uso real de tokens.
Parâmetros de Requisição: Temperatura e Top P
Controle a criatividade e o determinismo do modelo usando parâmetros padrão. temperature afeta a aleatoriedade; valores mais altos produzem saídas mais diversas, enquanto valores mais baixos tornam as respostas mais focadas. top_p filtra tokens por probabilidade cumulativa. Esses parâmetros funcionam juntos para moldar o tom de suas interações com a IA sem censura.
Você também pode definir max_tokens para limitar o comprimento da saída. O padrão é 2.048 tokens, mas você pode solicitar até 32.000 tokens por requisição. A janela de contexto total é de 100.000 tokens, incluindo prompt e conclusão. Use sequências stop para interromper a geração antecipadamente se necessário.
Formato de Resposta: Streaming e JSON
A API suporta streaming via Server-Sent Events (SSE) para entrega de tokens em tempo real. Isso é útil para construir interfaces de chat onde você deseja exibir tokens conforme são gerados. O último chunk contém o uso total de tokens para a requisição. Para dados estruturados, use response_format: {"type": "json_object"} para forçar saída JSON.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Chamada de funções (ferramentas) também é suportada. Defina suas ferramentas na requisição, e o modelo retornará argumentos estruturados que você pode analisar e executar. Isso permite fluxos de trabalho complexos sem sair da API de texto.
Exemplos de SDK (Python/Node.js)
A integração é direta se você usar os SDKs oficiais do OpenAI. Basta configurar o cliente com nossa base URL e sua chave. O SDK lida com retentativas e análise automaticamente.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Ambos os exemplos demonstram geração de texto básica. Substitua a chave de API placeholder pela sua chave real. O código funciona igualmente para ambientes Python e Node.js, aproveitando o mesmo protocolo subjacente. Isso garante uma curva de aprendizado baixa para desenvolvedores já familiarizados com o ecossistema do OpenAI.
Detalhes do Modelo, Limites e Erros
Nossa API sem censura tem limites específicos: 300 requisições por minuto por chave e 8 requisições simultâneas ao mesmo tempo. O tamanho máximo do corpo da requisição é 8 MB. Se você exceder o limite de requisições, receberá um erro 429. Falhas de autenticação retornam 401 e fundos insuficientes retornam 402.
O crédito é pré-pago e nunca expira. Erros e recusas são gratuitos. Observe que conteúdo sexual envolvendo menores é sempre recusado. Para outros conteúdos, o modelo é altamente permissivo. Se você encontrar problemas, entre em contato com o suporte para ajustes de crédito. O modelo não é GPT, Claude ou qualquer modelo de outro fornecedor; é um modelo de pesos abertos dedicado executado em nossos servidores.
Especificações técnicas
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Base URL | https://api.uncensoredai.top/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Modo JSON | response_format: {"type": "json_object"} |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Tamanho | até 8 MB por requisição |
| Validade | crédito pago não expira, sem assinatura |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Quanto custa a API de IA sem censura?
A API de IA sem censura custa $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. Você paga apenas pelo que usa, sem assinatura mensal. O crédito é recarregado via cripto e nunca expira.
A chave de API da IA sem censura é compartilhada com outros usuários?
Não, cada conta tem uma chave de API ativa exclusiva para você. Você pode gerar uma nova chave se necessário, o que substitui a antiga. A chave fornece acesso ao seu crédito pré-pago dedicado.
Qual é o tamanho da janela de contexto?
A janela de contexto total é de 100.000 tokens, incluindo prompt e conclusão. Você pode definir um máximo de saída de 32.000 tokens por requisição. Isso permite conversas longas ou processamento de documentos grandes.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a base URL. Essa é toda a configuração.