ES ▾
API de LLM sin censura para desarrolladoreshttps://api.uncensoredai.top/v1
Obtener clave de API

Cómo integrar la API de Uncensored AI

Integrar una API de IA sin censura te permite omitir los filtros de contenido para casos de uso creativos, adultos o de investigación, mientras usas SDKs estándar de OpenAI. Esta guía cubre la configuración técnica, desde la autenticación hasta el streaming, usando un endpoint de finalización de texto puro que cobra solo por el uso real de tokens.

Actualizado:

Puntos clave
  • La API usa un endpoint compatible con OpenAI en https://api.uncensoredai.top/v1, que requiere cero cambios de código para clientes existentes.
  • La tarifa es transparente: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida, sin suscripciones mensuales.
  • Los pagos se procesan exclusivamente mediante criptomonedas (USDT o USDC), permitiendo recargas instantáneas sin tarjetas de crédito.
  • El modelo admite streaming, modo JSON y llamadas a funciones en una ventana de contexto de 100k, pero no ofrece embeddings ni visión.

¿Por qué elegir una API de Uncensored AI?

La mayoría de proveedores de LLM comerciales implementan filtros de seguridad agresivos que pueden bloquear escritura creativa, roleplay o análisis técnico de temas controvertidos. Una API de IA sin censura elimina estos rechazos arbitrarios, permitiendo que el modelo responda basándose en sus datos de entrenamiento en lugar de una capa de política de contenido. Esto es especialmente útil para desarrolladores que construyen aplicaciones que requieren salidas crudas del modelo sin filtros de postprocesamiento.

A diferencia de los agregadores de modelos que enrutan peticiones a múltiples proveedores, este servicio proporciona un modelo único y dedicado. Esto elimina la imprevisibilidad de la lógica de enrutamiento y asegura un comportamiento consistente en todas las peticiones. El modelo es una variante de pesos abiertos ajustada específicamente para minimizar rechazos para contenido adulto lícito, investigación de seguridad y narrativas de ficción.

Sin embargo, 'sin censura' no significa ilimitado. El servicio aún aplica un límite estricto sobre contenido sexual con menores. Para la mayoría de los demás casos de uso, incluyendo temas maduros o lógica inusual, el modelo generará una respuesta. Este enfoque es ideal para desarrolladores que quieren control total sobre la estrategia de contenido de su aplicación sin depender del gusto del proveedor.

Configuración de tu entorno

La integración comienza apuntando tu SDK compatible con OpenAI a la URL base correcta. El endpoint se aloja en https://api.uncensoredai.top/v1. Esto significa que puedes usar las bibliotecas oficiales de OpenAI para Python o Node.js sin reescribir la lógica de tu cliente. Solo necesitas actualizar el parámetro base_url y proporcionar tu clave de API.

El servicio soporta una ventana de contexto de 100.000 tokens, significativamente mayor que muchas ofertas estándar. Esto permite historiales de prompt extensos o procesamiento de documentos grandes. Ten en cuenta que la salida máxima por petición es de 32.000 tokens. Si no especificas max_tokens, el valor predeterminado es 2.048 tokens.

  • Compatibilidad con SDK: Funciona con cualquier cliente que utilice el protocolo OpenAI Chat Completions.
  • Ventana de contexto: 100k tokens en total (entrada + salida).
  • Salida máxima: 32k tokens por petición.

Asegúrate de que las variables de entorno estén configuradas correctamente para evitar problemas de latencia. La API está diseñada para una integración directa basada en código, por lo que no hay interfaz web que aprender. Interactúas con ella puramente a través de peticiones HTTP.

Autenticación y encabezados

La autenticación se maneja mediante el encabezado estándar Authorization. Recibirás una única clave de API al registrarte. A diferencia de los servicios que emiten varias claves por cuenta, esta plataforma limita la cuenta a una clave activa. Si generas una nueva clave, la anterior se invalida de inmediato.

Para autenticar una petición, incluye el encabezado: Authorization: Bearer YOUR_API_KEY. El servicio también proporciona un endpoint GET /v1/models, que devuelve la información de los modelos disponibles, incluido el ID del modelo uncensored. Esto es útil para verificar la conectividad antes de enviar cargas complejas.

Límites de velocidad:

  • 300 peticiones por minuto por clave.
  • 8 peticiones simultáneas al mismo tiempo por clave.
  • 8 MB de tamaño máximo del cuerpo de la petición.

Estos límites son generosos para la mayoría de aplicaciones pero deben respetarse para evitar errores 429. Como no hay nivel de suscripción, estos límites se aplican uniformemente a todos los usuarios independientemente del saldo de crédito.

Envío de tu primera petición de finalización

Una petición básica sigue el formato estándar de Chat Completions. Envías un payload JSON con el model configurado como uncensored y tu array de messages. El servicio devuelve una respuesta de texto. No hay endpoints de embeddings, visión ni audio: esta es una API de texto puro.

Ejemplo de petición:

Lo siguiente demuestra una finalización de chat estándar. Reemplaza YOUR_API_KEY con tu clave real.

curl https://api.uncensoredai.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La respuesta contendrá el texto generado en choices[0].message.content. Los errores se devuelven en formato HTTP estándar, lo que te permite manejar reintentos o fallos de forma elegante. Ten en cuenta que los errores no consumen tu crédito, por lo que puedes probar libremente.

Para desarrolladores familiarizados con OpenAI, la experiencia es idéntica. La única diferencia es la URL base y el comportamiento del modelo respecto a los filtros de contenido. Esta consistencia reduce la curva de aprendizaje para equipos que ya usan herramientas compatibles con OpenAI.

Manejo de respuestas en streaming

Se admite streaming mediante Server-Sent Events (SSE). Esto te permite recibir tokens a medida que se generan, proporcionando una mejor experiencia de usuario para respuestas largas. El endpoint de streaming es el mismo que el de no streaming; solo debes establecer stream: true en tu petición.

Beneficios del streaming:

  • Menor latencia percibida para los usuarios.
  • Capacidad de mostrar resultados parciales en tiempo real.
  • Uso eficiente de la memoria ya que los tokens se procesan de forma incremental.

El último fragmento de una respuesta en streaming incluye las estadísticas de uso de tokens. Esto es crucial para la precisión de la facturación, ya que puedes rastrear exactamente cuántos tokens se consumieron. Los errores durante el streaming pueden dar lugar a respuestas parciales, por lo que tu cliente debe manejar los fragmentos incompletos de forma elegante.

Ejemplo de código:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Asegúrate de que tu biblioteca cliente maneje correctamente el flujo SSE. La mayoría de los SDK modernos lo abstraen, pero entender el protocolo subyacente ayuda a depurar problemas de conexión o errores de análisis.

Funciones avanzadas: Modo JSON y Herramientas

La API admite salidas estructuradas mediante response_format establecido en {"type": "json_object"}. Esto obliga al modelo a devolver JSON válido, lo cual es esencial para la integración con otros sistemas de software. Esta función es particularmente útil para la extracción de datos o la generación de archivos de configuración.

También se admiten las llamadas a funciones. Puedes definir herramientas en tu petición y el modelo devolverá llamadas a herramientas en su respuesta. Esto permite flujos de trabajo complejos donde el LLM puede desencadenar acciones externas. El parámetro tool_choice te permite forzar herramientas específicas o permitir que el modelo decida.

Parámetros clave:

  • temperature: Controla la aleatoriedad.
  • top_p: Controla la diversidad.
  • stop: Define secuencias de parada.
  • seed: Para respuestas deterministas.

Estas características hacen que la API sea adecuada para aplicaciones de producción que requieren datos estructurados y fiables. Aunque el modelo es sin censura, sigue respetando las restricciones estructurales cuando se le solicita. Este equilibrio entre libertad y estructura es una ventaja clave para los desarrolladores que crean agentes complejos.

Monitoreo de uso y límites

El uso se rastrea por clave de API. El panel muestra tu saldo actual de crédito y el historial reciente de peticiones. Dado que la facturación se basa en el uso real de tokens, puedes supervisar tus costos en tiempo real. El servicio no cobra por errores o denegaciones, lo que puede ahorrar dinero durante las fases de prueba.

Métricas de uso:

  • Tokens de entrada: Se cobran $0,25 por cada 1M de tokens.
  • Tokens de salida: Se cobran $1,00 por cada 1M de tokens.
  • Errores: Gratis.

Puedes configurar alertas si tu biblioteca de cliente lo admite, pero la supervisión principal se realiza a través del panel de la cuenta. El límite de 300 peticiones por minuto garantiza un uso justo para todos los usuarios. Si superas este límite, recibirás un código de estado 429.

Para aplicaciones de alto volumen, considera implementar un retroceso exponencial para los reintentos. El servicio está diseñado para ser fiable, pero pueden ocurrir problemas de red o límites de velocidad. Rastrear tu uso de tokens te ayuda a planificar eficazmente, especialmente ya que los créditos no caducan.

Gestión de créditos mediante criptomonedas

Los pagos se procesan exclusivamente mediante criptomonedas. Puedes recargar tu cuenta con USDT (TRC20) o USDC (Base). El monto mínimo de recarga es de $10 y el máximo es de $500. No hay suscripciones mensuales ni tarifas recurrentes.

Créditos adicionales:

  • Recarga de $50: +5% de crédito adicional.
  • Recarga de $100: +10% de crédito adicional.

Los créditos no caducan, por lo que puedes recargar una vez y usarlos con el tiempo. Esto es ideal para proyectos a largo plazo donde el consumo de tokens varía. La falta de tarifas de procesamiento de tarjetas de crédito hace que las criptomonedas sean una opción rentable para los desarrolladores que ya poseen monedas estables.

Proceso de pago:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Para pagar, genera una dirección de depósito desde tu panel, envía la criptomoneda y el crédito se añade automáticamente. Los reembolsos no están disponibles para los créditos, pero los errores como cobros dobles se solucionan a través de la página de Soporte. Este modelo reduce la fricción para desarrolladores globales que puedan enfrentar restricciones bancarias.

Preguntas y respuestas

¿Es esta API adecuada para uso en producción?

Sí, la API está diseñada para producción con soporte para streaming, modo JSON y herramientas. Tiene un límite de 300 peticiones por minuto y 8 peticiones simultáneas, lo cual es suficiente para la mayoría de las aplicaciones. Sin embargo, no ofrece un SLA ni garantía de disponibilidad, por lo que deberías implementar reintentos en tu cliente.

¿Qué sucede si hago una petición que es rechazada?

Si una petición se deniega debido al límite estricto de contenido (contenido sexual que implica menores), no se te cobrará por esa petición. Otras denegaciones, como las basadas en el propio juicio del modelo, aún pueden incurrir en costos de tokens. Los errores de procesamiento siempre son gratuitos.

¿Puedo usar esta API con el SDK oficial de OpenAI?

Sí, la API es totalmente compatible con OpenAI. Solo necesitas cambiar la URL base a https://api.uncensoredai.top/v1 y actualizar tu clave de API. El ID del modelo es 'uncensored'. Todos los demás parámetros como temperature, top_p y herramientas funcionan según lo documentado por OpenAI.

¿Cómo empiezo con una prueba?

Cada nueva cuenta recibe $0,50 de crédito de prueba válido por 7 días. Puedes registrarte con Google o una dirección de correo electrónico sin necesidad de una tarjeta de crédito. Esto te permite probar la latencia de la API, la calidad de la respuesta y las características de streaming antes de comprar créditos.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API