- L'API utilise un endpoint standard compatible OpenAI à https://api.uncensoredai.top/v1, nécessitant zéro modification de code pour les clients existants.
- La tarification est transparente à 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie, sans abonnements mensuels.
- Les paiements sont traités exclusivement via crypto (USDT ou USDC), permettant des recharges instantanées sans carte bancaire.
- Le modèle prend en charge le streaming, le mode JSON et l'appel de fonctions dans une fenêtre de contexte de 100k, mais ne propose pas d'embeddings ni de vision.
Pourquoi choisir une API Uncensored AI ?
La plupart des fournisseurs de LLM commerciaux implémentent des filtres de sécurité agressifs qui peuvent bloquer l'écriture créative, le jeu de rôle ou l'analyse technique de sujets controversés. Une API IA sans censure supprime ces refus arbitraires, permettant au modèle de répondre en fonction de ses données d'entraînement plutôt que d'une couche de politique de contenu. Cela est particulièrement utile pour les développeurs créant des applications nécessitant des sorties brutes du modèle sans filtres post-traitement.
Contrairement aux agrégateurs de modèles qui routent les requêtes vers plusieurs fournisseurs, ce service fournit un modèle unique et dédié. Cela élimine l'imprévisibilité de la logique de routage et garantit un comportement cohérent entre les requêtes. Le modèle est une variante à poids ouverts ajustée spécifiquement pour minimiser les refus pour le contenu adulte légal, la recherche en sécurité et les récits de fiction.
Cependant, « uncensored » ne signifie pas sans limite. Le service applique toujours une limite stricte sur le contenu sexuel impliquant des mineurs. Pour la plupart des autres cas d'utilisation, y compris les thèmes matures ou la logique non conventionnelle, le modèle générera une réponse. Cette approche est idéale pour les développeurs qui souhaitent un contrôle total sur la stratégie de contenu de leur application sans dépendre du goût du fournisseur.
Configuration de votre environnement
L'intégration commence par pointer votre SDK compatible OpenAI vers l'URL de base correcte. L'endpoint est hébergé à https://api.uncensoredai.top/v1. Cela signifie que vous pouvez utiliser les bibliothèques officielles OpenAI Python ou Node.js sans réécrire la logique de votre client. Vous devez uniquement mettre à jour le paramètre base_url et fournir votre clé API.
Le service prend en charge une fenêtre de contexte de 100 000 tokens, ce qui est nettement supérieur à de nombreuses offres standard. Cela permet des historiques de prompt étendus ou le traitement de grands documents. Gardez à l'esprit que la sortie maximale par requête est de 32 000 tokens. Si vous ne spécifiez pas max_tokens, la valeur par défaut est de 2 048 tokens.
- Compatibilité SDK : Fonctionne avec tout client compatible avec le protocole OpenAI Chat Completions.
- Fenêtre de contexte : 100k tokens au total (entrée + sortie).
- Sortie max : 32k tokens par requête.
Assurez-vous que vos variables d'environnement sont définies correctement pour éviter les problèmes de latence. L'API est conçue pour une intégration directe orientée code, il n'y a pas d'interface web à apprendre. Vous interagissez avec elle uniquement via des requêtes HTTP.
Authentification et En-têtes
L'authentification est gérée via l'en-tête standard Authorization. Vous recevrez une seule clé API lors de l'inscription. Contrairement aux services qui émettent plusieurs clés par compte, cette plateforme impose une clé active par compte. Si vous générez une nouvelle clé, l'ancienne est immédiatement invalidée.
Pour authentifier une requête, incluez l'en-tête : Authorization: Bearer YOUR_API_KEY. Le service propose également un endpoint GET /v1/models qui renvoie les informations sur les modèles disponibles, y compris l'ID du modèle uncensored. Cela est utile pour vérifier la connectivité avant d'envoyer des requêtes complexes.
Limites de débit :
- 300 requêtes par minute par clé.
- 8 requêtes simultanées au même moment par clé.
- Taille maximale du corps de la requête : 8 MB.
Ces limites sont généreuses pour la plupart des applications mais doivent être respectées pour éviter les erreurs 429. Comme il n'y a pas de niveau d'abonnement, ces limites s'appliquent uniformément à tous les utilisateurs quel que soit leur solde de crédit.
Envoi de votre première requête de complétion
Une requête de base suit le format standard Chat Completions. Vous envoyez un payload JSON avec model défini sur uncensored et votre tableau messages. Le service retourne une réponse textuelle. Il n'y a pas d'endpoints d'embeddings, de vision ou d'audio—c'est une API purement textuelle.
Exemple de requête :
Ce qui suit illustre une complétion de chat standard. Remplacez YOUR_API_KEY par votre clé réelle.
curl https://api.uncensoredai.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'La réponse contiendra le texte généré dans choices[0].message.content. Les erreurs sont retournées au format HTTP standard, vous permettant de gérer les tentatives de reconnexion ou les échecs avec élégance. Notez que les erreurs ne consomment pas votre crédit, vous pouvez donc tester librement.
Pour les développeurs familiers avec OpenAI, l'expérience est identique. La seule différence est l'URL de base et le comportement du modèle concernant les filtres de contenu. Cette cohérence réduit la courbe d'apprentissage pour les équipes utilisant déjà des outils compatibles OpenAI.
Gestion des réponses en streaming
Le streaming est pris en charge via les Server-Sent Events (SSE). Cela vous permet de recevoir les tokens au fur et à mesure de leur génération, offrant une meilleure expérience utilisateur pour les réponses longues. L'endpoint de streaming est le même que celui sans streaming ; vous définissez simplement stream: true dans votre requête.
Avantages du streaming :
- Latence perçue plus faible pour les utilisateurs.
- Possibilité d'afficher des résultats partiels en temps réel.
- Utilisation efficace de la mémoire car les tokens sont traités de manière incrémentale.
Le dernier bloc d'une réponse en streaming inclut les statistiques d'utilisation des tokens. Cela est crucial pour la précision de la facturation, car vous pouvez suivre exactement combien de tokens ont été consommés. Les erreurs lors du streaming peuvent entraîner des réponses partielles, donc votre client doit gérer les blocs incomplets avec élégance.
Exemple de code :
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Assurez-vous que votre bibliothèque cliente gère correctement le flux SSE. La plupart des SDK modernes l'abstrait, mais comprendre le protocole sous-jacent aide au débogage des problèmes de connexion ou d'analyse.
Fonctionnalités avancées : Mode JSON et Outils
L'API prend en charge les sorties structurées via response_format défini sur {"type": "json_object"}. Cela force le modèle à renvoyer du JSON valide, ce qui est essentiel pour l'intégration avec d'autres systèmes logiciels. Cette fonctionnalité est particulièrement utile pour l'extraction de données ou la génération de fichiers de configuration.
L'appel de fonctions est également pris en charge. Vous pouvez définir des outils dans votre requête, et le modèle retournera des appels d'outils dans sa réponse. Cela permet des workflows complexes où le LLM peut déclencher des actions externes. Le paramètre tool_choice vous permet de forcer des outils spécifiques ou de laisser le modèle décider.
Paramètres clés :
temperature: Contrôle l'aléatoire.top_p: Contrôle la diversité.stop: Définit les séquences d'arrêt.seed: Pour des réponses déterministes.
Ces fonctionnalités rendent l'API adaptée aux applications de production nécessitant des données structurées fiables. Bien que le modèle soit sans censure, il respecte toujours les contraintes structurelles lorsqu'on le lui demande. Cet équilibre entre liberté et structure est un avantage clé pour les développeurs créant des agents complexes.
Suivi de l'utilisation et des limites
L'utilisation est suivie par clé API. Le tableau de bord affiche votre solde de crédit actuel et l'historique récent des requêtes. La facturation étant basée sur l'utilisation réelle des tokens, vous pouvez surveiller vos coûts en temps réel. Le service ne facture pas les erreurs ou les refus, ce qui permet de réaliser des économies lors des phases de test.
Métriques d'utilisation :
- Tokens d'entrée : facturés à 0,25 $ par 1 M de tokens.
- Tokens de sortie : facturés à 1,00 $ par 1 M de tokens.
- Erreurs : gratuites.
Vous pouvez configurer des alertes si votre bibliothèque cliente le prend en charge, mais la surveillance principale s'effectue via le tableau de bord du compte. La limite de 300 requêtes par minute garantit une utilisation équitable pour tous les utilisateurs. Si vous dépassez ce seuil, vous recevrez un code d'état 429.
Pour les applications à fort volume, envisagez de mettre en œuvre une rétrogradation exponentielle pour les nouvelles tentatives. Le service est conçu pour être fiable, mais des problèmes réseau ou des limites de débit peuvent survenir. Le suivi de votre consommation de tokens vous aide à budgétiser efficacement, d'autant plus que les crédits n'expirent jamais.
Gestion des crédits via la crypto
Les paiements sont traités exclusivement en cryptomonnaie. Vous pouvez recharger votre compte avec USDT (TRC20) ou USDC (Base). Le montant minimum de rechargement est de 10 $ et le maximum est de 500 $. Il n'y a ni abonnements mensuels ni frais récurrents.
Crédits bonus :
- Rechargement de 50 $ : +5 % de crédit bonus.
- Rechargement de 100 $ : +10 % de crédit bonus.
Les crédits n'expirent jamais, vous pouvez donc recharger une fois et les utiliser au fil du temps. C'est idéal pour les projets à long terme où la consommation de tokens varie. L'absence de frais de traitement par carte bancaire fait de la crypto une option rentable pour les développeurs détenant déjà des stablecoins.
Processus de paiement :
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Pour payer, générez une adresse de dépôt depuis votre tableau de bord, envoyez la crypto et le crédit est ajouté automatiquement. Les remboursements ne sont pas disponibles pour les crédits, mais les erreurs comme les doubles facturations sont corrigées via la page Support. Ce modèle réduit les frictions pour les développeurs du monde entier qui peuvent rencontrer des restrictions bancaires.
Questions et réponses
Cette API est-elle adaptée à un usage en production ?
Oui, l'API est conçue pour la production avec prise en charge du streaming, du mode JSON et des outils. Elle dispose d'une limite de 300 requêtes par minute et de 8 requêtes simultanées, ce qui est suffisant pour la plupart des applications. Cependant, elle ne propose pas de SLA ni de garantie de disponibilité, vous devez donc mettre en œuvre des nouvelles tentatives dans votre client.
Que se passe-t-il si je fais une requête qui est refusée ?
Si une requête est refusée en raison de la limite stricte de contenu (contenu sexuel impliquant des mineurs), vous n'êtes pas facturé pour cette requête. D'autres refus, basés sur le jugement propre du modèle, peuvent toujours entraîner des coûts en tokens. Les erreurs de traitement sont toujours gratuites.
Puis-je utiliser cette API avec le SDK officiel OpenAI ?
Oui, l'API est entièrement compatible OpenAI. Il vous suffit de modifier l'URL de base vers https://api.uncensoredai.top/v1 et de mettre à jour votre clé API. L'ID du modèle est « uncensored ». Tous les autres paramètres, tels que temperature, top_p et les tool_calls, fonctionnent comme indiqué dans la documentation d'OpenAI.
Comment commencer avec un essai ?
Chaque nouveau compte reçoit 0,50 $ de crédit d'essai gratuit valable 7 jours. Vous pouvez vous inscrire avec Google ou une adresse e-mail sans avoir besoin d'une carte bancaire. Cela vous permet de tester la latence de l'API, la qualité des réponses et les fonctionnalités de streaming avant d'acheter des crédits.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.