PT ▾
API LLM sem censura para desenvolvedoreshttps://api.uncensoredai.top/v1
Obter chave de API

Como integrar a API Uncensored AI

Integrar uma API de IA sem censura permite contornar filtros de conteúdo para casos de uso criativos, adultos ou de pesquisa, enquanto usa SDKs padrão da OpenAI. Este guia cobre a configuração técnica, desde a autenticação até o streaming, usando um endpoint de conclusão de texto puro que cobra apenas pelo uso real de tokens.

Atualizado:

Pontos-chave
  • A API usa um endpoint padrão compatível com OpenAI em https://api.uncensoredai.top/v1,, exigindo zero alterações de código para clientes existentes.
  • O preço é transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída, sem assinaturas mensais.
  • Os pagamentos são processados exclusivamente via cripto (USDT ou USDC), permitindo recarregamentos instantâneos sem cartões de crédito.
  • O modelo suporta streaming, modo JSON e chamada de funções em uma janela de contexto de 100k, mas não oferece embeddings ou visão.

Por que escolher uma API Uncensored AI?

A maioria dos provedores de LLM comerciais implementa filtros de segurança agressivos que podem bloquear escrita criativa, roleplay ou análise técnica de tópicos controversos. Uma API de IA sem censura remove essas recusas arbitrárias, permitindo que o modelo responda com base em seus dados de treinamento, em vez de uma camada de política de conteúdo. Isso é particularmente útil para desenvolvedores que constroem aplicativos que exigem saídas brutas do modelo sem filtros de pós-processamento.

Ao contrário de agregadores de modelos que roteiam solicitações para vários fornecedores, este serviço fornece um modelo único e dedicado. Isso elimina a imprevisibilidade da lógica de roteamento e garante comportamento consistente entre as solicitações. O modelo é uma variante de pesos abertos ajustada especificamente para minimizar recusas para conteúdo adulto lícito, pesquisa de segurança e narrativas fictícias.

No entanto, 'sem censura' não significa ilimitado. O serviço ainda impõe um limite rígido sobre conteúdo sexual envolvendo menores. Para a maioria dos outros casos de uso, incluindo temas maduros ou lógica não convencional, o modelo gerará uma resposta. Esta abordagem é ideal para desenvolvedores que querem controle total sobre a estratégia de conteúdo de seu aplicativo, sem depender do gosto do provedor.

Configurando seu ambiente

A integração começa apontando seu SDK compatível com OpenAI para a URL base correta. O endpoint é hospedado em https://api.uncensoredai.top/v1. Isso significa que você pode usar as bibliotecas oficiais do OpenAI para Python ou Node.js sem reescrever a lógica do seu cliente. Você só precisa atualizar o parâmetro base_url e fornecer sua chave de API.

O serviço suporta uma janela de contexto de 100.000 tokens, significativamente maior que muitas ofertas padrão. Isso permite históricos de prompt extensos ou processamento de documentos grandes. Tenha em mente que a saída máxima por solicitação é de 32.000 tokens. Se você não especificar max_tokens, o padrão é 2.048 tokens.

  • Compatibilidade com SDK: Funciona com qualquer cliente que utilize o protocolo OpenAI Chat Completions.
  • Janela de contexto: 100k tokens no total (entrada + saída).
  • Saída máxima: 32k tokens por solicitação.

Certifique-se de que suas variáveis de ambiente estejam definidas corretamente para evitar problemas de latência. A API foi projetada para integração direta via código, então não há interface web para aprender. Você interage com ela puramente por meio de solicitações HTTP.

Autenticação e Cabeçalhos

A autenticação é feita por meio do cabeçalho Authorization padrão. Você receberá uma única chave de API ao se cadastrar. Diferente de serviços que emitem várias chaves por conta, esta plataforma permite apenas uma chave ativa por conta. Se você gerar uma nova chave, a anterior será imediatamente invalidada.

Para autenticar uma requisição, inclua o cabeçalho: Authorization: Bearer YOUR_API_KEY. O serviço também oferece o endpoint GET /v1/models, que retorna informações sobre os modelos disponíveis, incluindo o ID do modelo uncensored. Isso é útil para verificar a conectividade antes de enviar payloads complexos.

Limites de Requisição

  • 300 requisições por minuto por chave.
  • 8 requisições simultâneas ao mesmo tempo por chave.
  • 8 MB de tamanho máximo do corpo da solicitação.

Esses limites são generosos para a maioria dos aplicativos, mas devem ser respeitados para evitar erros 429. Como não há plano de assinatura, esses limites se aplicam uniformemente a todos os usuários, independentemente do saldo de crédito.

Enviando sua primeira solicitação de conclusão

Uma solicitação básica segue o formato padrão de Chat Completions. Você envia um payload JSON com o model definido como uncensored e seu array de messages. O serviço retorna uma resposta de texto. Não há endpoints de embeddings, visão ou áudio — esta é uma API de texto puro.

Exemplo de solicitação:

O exemplo a seguir demonstra uma conclusão de chat padrão. Substitua YOUR_API_KEY pela sua chave real.

curl https://api.uncensoredai.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

A resposta conterá o texto gerado em choices[0].message.content. Erros são retornados no formato HTTP padrão, permitindo que você gerencie retentativas ou falhas de forma elegante. Observe que erros não consomem seu crédito, então você pode testar livremente.

Para desenvolvedores familiarizados com OpenAI, a experiência é idêntica. A única diferença é a URL base e o comportamento do modelo em relação aos filtros de conteúdo. Essa consistência reduz a curva de aprendizado para equipes que já usam ferramentas compatíveis com OpenAI.

Gerenciando Respostas em Streaming

O streaming é suportado via Server-Sent Events (SSE). Isso permite que você receba tokens conforme são gerados, proporcionando uma melhor experiência do usuário para respostas longas. O endpoint de streaming é o mesmo que o de não-streaming; você apenas define stream: true na sua requisição.

Benefícios do streaming:

  • Latência percebida menor para os usuários.
  • Capacidade de exibir resultados parciais em tempo real.
  • Uso eficiente de memória, pois os tokens são processados incrementalmente.

O último pedaço de uma resposta em streaming inclui as estatísticas de uso de tokens. Isso é crucial para a precisão da cobrança, pois você pode rastrear exatamente quantos tokens foram consumidos. Erros durante o streaming podem resultar em respostas parciais, portanto, seu cliente deve lidar com pedaços incompletos de forma elegante.

Exemplo de código:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Certifique-se de que sua biblioteca de cliente lide corretamente com o stream SSE. A maioria dos SDKs modernos abstrai isso, mas entender o protocolo subjacente ajuda na depuração de problemas de conexão ou erros de análise.

Recursos avançados: Modo JSON e Ferramentas

A API suporta saídas estruturadas definindo response_format como {"type": "json_object"}. Isso força o modelo a retornar JSON válido, o que é essencial para integrar com outros sistemas de software. Este recurso é particularmente útil para extração de dados ou geração de arquivos de configuração.

A chamada de funções também é suportada. Você pode definir ferramentas em sua solicitação, e o modelo retornará chamadas de ferramentas em sua resposta. Isso permite fluxos de trabalho complexos onde o LLM pode acionar ações externas. O parâmetro tool_choice permite forçar ferramentas específicas ou deixar que o modelo decida.

Parâmetros-chave:

  • temperature: Controla a aleatoriedade.
  • top_p: Controla a diversidade.
  • stop: Define sequências de parada.
  • seed: Para respostas determinísticas.

Esses recursos tornam a API adequada para aplicativos de produção que exigem dados estruturados confiáveis. Embora o modelo seja sem censura, ele ainda adere a restrições estruturais quando solicitado. Esse equilíbrio entre liberdade e estrutura é uma vantagem chave para desenvolvedores que constroem agentes complexos.

Monitorando Uso e Limites

O uso é rastreado por chave de API. O painel mostra seu saldo atual de crédito e o histórico recente de requisições. Como a cobrança é baseada no uso real de tokens, você pode monitorar seus custos em tempo real. O serviço não cobra por erros ou recusas, o que pode economizar dinheiro durante fases de teste.

Métricas de Uso:

  • Tokens de entrada: Cobrados a $0,25 por 1M de tokens.
  • Tokens de saída: Cobrados a $1.00 por 1M de tokens.
  • Erros: Grátis.

Você pode configurar alertas se sua biblioteca de cliente suportar, mas o monitoramento principal é feito através do painel da conta. O limite de 300 requisições por minuto garante uso justo para todos os usuários. Se você exceder isso, receberá um código de status 429.

Para aplicativos de alto volume, considere implementar backoff exponencial para novas tentativas. O serviço é projetado para ser confiável, mas problemas de rede ou limites de requisições podem ocorrer. Rastrear o uso de tokens ajuda você a orçar efetivamente, especialmente como os créditos nunca expiram.

Gerenciando Créditos via Cripto

Os pagamentos são processados exclusivamente via criptomoeda. Você pode recarregar sua conta com USDT (TRC20) ou USDC (Base). O valor mínimo de recarga é $10 e o máximo é $500. Não há assinaturas mensais ou taxas recorrentes.

Créditos Bônus:

  • Recarga de $50: +5% de crédito bônus.
  • Recarga de $100: +10% de crédito bônus.

Os créditos nunca expiram, então você pode recarregar uma vez e usá-los ao longo do tempo. Isso é ideal para projetos de longo prazo onde o consumo de tokens varia. A ausência de taxas de processamento de cartão de crédito torna a cripto uma opção econômica para desenvolvedores que já possuem stablecoins.

Processo de Pagamento:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Para pagar, gere um endereço de depósito no seu painel, envie a cripto e o crédito é adicionado automaticamente. Reembolsos não estão disponíveis para créditos, mas erros como cobranças duplicadas são corrigidos pela página de Suporte. Este modelo reduz a fricção para desenvolvedores globais que podem enfrentar restrições bancárias.

Perguntas e respostas

Esta API é adequada para uso em produção?

Sim, a API é projetada para produção com suporte para streaming, modo JSON e ferramentas. Ela tem um limite de 300 requisições por minuto e 8 requisições simultâneas, o que é suficiente para a maioria dos aplicativos. No entanto, ela não oferece SLA ou garantia de disponibilidade, então você deve implementar novas tentativas no seu cliente.

O que acontece se eu fizer uma requisição que é recusada?

Se uma requisição for recusada devido ao limite rígido de conteúdo (conteúdo sexual envolvendo menores), você não será cobrado por essa requisição. Outras recusas, como as baseadas no próprio julgamento do modelo, ainda podem incorrer em custos de tokens. Erros no processamento são sempre gratuitos.

Posso usar esta API com o SDK oficial da OpenAI?

Sim, a API é totalmente compatível com OpenAI. Você só precisa alterar a URL base para https://api.uncensoredai.top/v1 e atualizar sua chave de API. O ID do modelo é 'uncensored'. Todos os outros parâmetros como temperature, top_p e tools funcionam conforme documentado pela OpenAI.

Como começar com uma avaliação?

Cada nova conta recebe $0,50 de crédito de teste válido por 7 dias. Você pode entrar usando Google ou um endereço de e-mail sem precisar de cartão de crédito. Isso permite que você teste a latência da API, a qualidade da resposta e os recursos de streaming antes de comprar créditos.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API