- Die API verwendet einen standardmäßigen OpenAI-kompatiblen Endpunkt unter https://api.uncensoredai.top/v1,, der bei bestehenden Clients keine Codeänderungen erfordert.
- Die Preise sind transparent: $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token, ohne monatliche Abonnements.
- Zahlungen werden ausschließlich über Krypto (USDT oder USDC) verarbeitet, was sofortige Aufladungen ohne Kreditkarte ermöglicht.
- Das Modell unterstützt Streaming, JSON-Modus und Function Calling innerhalb eines 100k-Kontextfensters, bietet jedoch keine Embeddings oder Vision.
Warum eine Uncensored AI API wählen?
Die meisten kommerziellen LLM-Anbieter implementieren aggressive Sicherheitsfilter, die kreative Texte, Rollenspiele oder technische Analysen zu kontroversen Themen blockieren können. Eine unzensierte KI-API entfernt diese willkürlichen Ablehnungen und ermöglicht es dem Modell, basierend auf seinen Trainingsdaten und nicht auf einer Inhaltsrichtlinie zu antworten. Dies ist besonders nützlich für Entwickler, die Anwendungen erstellen, die Rohtextausgaben des Modells ohne nachgelagerte Filter erfordern.
Im Gegensatz zu Modell-Aggregatoren, die Anfragen an mehrere Anbieter weiterleiten, bietet dieser Dienst ein einzelnes, dediziertes Modell. Dies eliminiert die Unvorhersehbarkeit der Routing-Logik und gewährleistet ein konsistentes Verhalten über Anfragen hinweg. Das Modell ist eine Open-Weight-Variante, die speziell darauf abgestimmt ist, Ablehnungen für legale erwachsene Inhalte, Sicherheitsforschung und fiktionale Erzählungen zu minimieren.
„Unzensiert“ bedeutet jedoch nicht „unbegrenzt“. Der Dienst enforced weiterhin eine harte Grenze für sexuelle Inhalte mit Minderjährigen. Für die meisten anderen Anwendungsfälle, einschließlich reifer Themen oder unkonventioneller Logik, wird das Modell eine Antwort generieren. Dieser Ansatz ist ideal für Entwickler, die die volle Kontrolle über die Inhaltsstrategie ihrer Anwendung wünschen, ohne sich auf den Geschmack des Anbieters zu verlassen.
Einrichtung deiner Umgebung
Die Integration beginnt damit, dass du dein OpenAI-kompatibles SDK auf die korrekte Basis-URL zeigst. Der Endpunkt ist unter https://api.uncensoredai.top/v1 gehostet. Das bedeutet, dass du die offiziellen OpenAI Python- oder Node.js-Bibliotheken verwenden kannst, ohne deine Client-Logik neu schreiben zu müssen. Du musst nur den base_url-Parameter aktualisieren und deinen API-Schlüssel angeben.
Der Dienst unterstützt ein 100.000-Token-Kontextfenster, das erheblich größer ist als viele Standardangebote. Dies ermöglicht umfangreiche Prompt-Verläufe oder die Verarbeitung großer Dokumente. Beachte, dass die maximale Ausgabe pro Anfrage 32.000 Token beträgt. Wenn du max_tokens nicht angibst, beträgt der Standardwert 2.048 Token.
- SDK-Kompatibilität: Funktioniert mit jedem Client, der das OpenAI Chat Completions Protocol spricht.
- Kontextfenster: 100k Token insgesamt (Input + Output).
- Maximale Ausgabe: 32k Token pro Anfrage.
Stelle sicher, dass deine Umgebungsvariablen korrekt eingestellt sind, um Latenzprobleme zu vermeiden. Die API ist für eine direkte, code-basierte Integration ausgelegt, es gibt also keine Web-Oberfläche, die du lernen musst. Du interagierst ausschließlich über HTTP-Anfragen damit.
Authentifizierung und Header
Die Authentifizierung erfolgt über den standardmäßigen Authorization-Header. Du erhältst nach der Anmeldung einen einzelnen API-Schlüssel. Im Gegensatz zu Diensten, die mehrere Schlüssel pro Konto ausstellen, erzwingt diese Plattform einen aktiven Schlüssel pro Konto. Wenn du einen neuen Schlüssel generierst, wird der vorherige sofort ungültig.
Um eine Anfrage zu authentifizieren, füge den Header hinzu: Authorization: Bearer YOUR_API_KEY. Der Dienst bietet auch einen GET /v1/models-Endpunkt, der die verfügbaren Modellinformationen zurückgibt, einschließlich der Modell-ID uncensored. Dies ist nützlich, um die Konnektivität zu überprüfen, bevor komplexe Payloads gesendet werden.
Ratenlimits:
- 300 Anfragen pro Minute pro Schlüssel.
- 8 parallele Anfragen gleichzeitig pro Schlüssel.
- Maximale Anforderungskörpergröße von 8 MB.
Diese Limits sind für die meisten Anwendungen großzügig, sollten aber beachtet werden, um 429-Fehler zu vermeiden. Da es keine Abonnementebene gibt, gelten diese Limits einheitlich für alle Benutzer, unabhängig vom Guthabenstand.
Erstellung deiner ersten Completion-Anfrage
Eine grundlegende Anfrage folgt dem standardmäßigen Chat Completions Format. Du sendst eine JSON-Payload mit dem model auf uncensored und deinem messages-Array. Der Dienst gibt eine Textantwort zurück. Es gibt keine Embedding-, Vision- oder Audio-Endpunkte – dies ist eine reine Text-API.
Beispielanfrage:
Das Folgende demonstriert eine Standard-Chat-Vervollständigung. Ersetze YOUR_API_KEY durch deinen tatsächlichen Schlüssel.
curl https://api.uncensoredai.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Die Antwort enthält den generierten Text in choices[0].message.content. Fehler werden im standardmäßigen HTTP-Format zurückgegeben, sodass du Wiederholungen oder Ausfälle ordnungsgemäß verarbeiten kannst. Beachte, dass Fehler dein Guthaben nicht verbrauchen, sodass du kostenlos testen kannst.
Für Entwickler, die mit OpenAI vertraut sind, ist die Erfahrung identisch. Der einzige Unterschied ist die Base URL und das Verhalten des Modells hinsichtlich Inhaltsfiltern. Diese Konsistenz reduziert die Lernkurve für Teams, die bereits OpenAI-kompatible Tools verwenden.
Verarbeitung von Streaming-Antworten
Streaming wird über Server-Sent Events (SSE) unterstützt. Dies ermöglicht es dir, Token zu empfangen, sobald sie generiert werden, was die Benutzererfahrung für lange Antworten verbessert. Der Streaming-Endpunkt ist derselbe wie der Nicht-Streaming-Endpunkt; du setzt einfach stream: true in deiner Anfrage.
Vorteile des Streamings:
- Geringere wahrgenommene Latenz für Benutzer.
- Möglichkeit, Teilergebnisse in Echtzeit anzuzeigen.
- Effiziente Speichernutzung, da Token inkrementell verarbeitet werden.
Der letzte Chunk einer Streaming-Antwort enthält die Token-Nutzungsstatistiken. Dies ist entscheidend für die Abrechnungsgenauigkeit, da du genau verfolgen kannst, wie viele Token verbraucht wurden. Fehler während des Streamings können zu Teilantworten führen, daher sollte dein Client unvollständige Chunks ordnungsgemäß verarbeiten.
Code-Beispiel:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Stelle sicher, dass deine Client-Bibliothek den SSE-Stream korrekt verarbeitet. Die meisten modernen SDKs abstrahieren dies, aber das Verständnis des zugrunde liegenden Protokolls hilft bei der Fehlersuche bei Verbindungsproblemen oder Parsing-Fehlern.
Erweiterte Funktionen: JSON-Modus und Tools
Die API unterstützt strukturierte Ausgaben über response_format auf {"type": "json_object"}. Dies zwingt das Modell, gültiges JSON zurückzugeben, was für die Integration in andere Softwaresysteme entscheidend ist. Diese Funktion ist besonders nützlich für die Datenextraktion oder die Generierung von Konfigurationsdateien.
Function Calling wird ebenfalls unterstützt. Du kannst Tools in deiner Anfrage definieren, und das Modell gibt Tool-Aufrufe in seiner Antwort zurück. Dies ermöglicht komplexe Workflows, bei denen die LLM externe Aktionen auslösen kann. Der Parameter tool_choice ermöglicht es dir, bestimmte Tools zu erzwingen oder das Modell entscheiden zu lassen.
Wichtige Parameter:
temperature: Steuert die Zufälligkeit.top_p: Steuert die Vielfalt.stop: Definiert Stoppsequenzen.seed: Für deterministische Antworten.
Diese Funktionen machen die API für Produktionsanwendungen geeignet, die zuverlässige, strukturierte Daten erfordern. Obwohl das Modell unzensiert ist, hält es sich dennoch an strukturelle Einschränkungen, wenn dies angefordert wird. Dieses Gleichgewicht aus Freiheit und Struktur ist ein entscheidender Vorteil für Entwickler, die komplexe Agenten erstellen.
Nutzung und Limits überwachen
Die Nutzung wird pro API-Schlüssel erfasst. Das Dashboard zeigt deinen aktuellen Guthabenstand und die jüngste Historie der Anfragen. Da die Abrechnung auf der tatsächlichen Token-Nutzung basiert, kannst du deine Kosten in Echtzeit überwachen. Der Service berechnet keine Gebühren für Fehler oder Ablehnungen, was in Testphasen Geld sparen kann.
Nutzungsstatistiken:
- Input-Token: Berechnet mit $0,25 pro 1 Mio. Token.
- Output-Token: Berechnet mit $1,00 pro 1 Mio. Token.
- Fehler: Kostenlos.
Du kannst Warnungen einrichten, falls deine Client-Bibliothek dies unterstützt, aber die primäre Überwachung erfolgt über das Kontodashboard. Das Limit von 300 Anfragen pro Minute gewährleistet eine faire Nutzung für alle Benutzer. Wenn du dieses Limit überschreitest, erhältst du einen 429-Statuscode.
Für Anwendungen mit hohem Volumen solltest du exponentielles Backoff für Wiederholungen implementieren. Der Service ist zuverlässig ausgelegt, aber Netzwerkprobleme oder Ratenlimits können auftreten. Die Verfolgung deiner Token-Nutzung hilft dir, effektiv zu budgeten, insbesondere da Guthaben verfallen nie.
Guthaben über Krypto verwalten
Zahlungen werden ausschließlich über Kryptowährung verarbeitet. Du kannst dein Konto mit USDT (TRC20) oder USDC (Base) aufladen. Der Mindestbetrag für eine Aufladung beträgt $10, der Höchstbetrag $500. Es gibt keine monatlichen Abonnements oder wiederkehrenden Gebühren.
Bonusguthaben:
- $50-Aufladung: +5 % Bonusguthaben.
- $100-Aufladung: +10 % Bonusguthaben.
Guthaben verfallen nie, sodass du einmal aufladen und sie über einen längeren Zeitraum nutzen kannst. Dies ist ideal für Langzeitprojekte, in denen der Token-Verbrauch schwankt. Das Fehlen von Kreditkartengebühren macht Krypto zu einer kostengünstigen Option für Entwickler, die bereits Stablecoins halten.
Zahlungsprozess:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Um zu bezahlen, generiere eine Einzahlungsadresse in deinem Dashboard, sende die Kryptowährung und das Guthaben wird automatisch gutgeschrieben. Rückerstattungen für Guthaben sind nicht verfügbar, Fehler wie Doppelbuchungen werden jedoch über die Support-Seite behoben. Dieses Modell reduziert Reibungsverluste für globale Entwickler, die möglicherweise Bankbeschränkungen unterliegen.
Fragen und Antworten
Ist diese API für den Produktiveinsatz geeignet?
Ja, die API ist für den Produktiveinsatz konzipiert und unterstützt Streaming, JSON-Modus und Tools. Sie verfügt über ein Limit von 300 Anfragen pro Minute und 8 parallele Anfragen, was für die meisten Anwendungen ausreicht. Sie bietet jedoch kein SLA oder eine Verfügbarkeitsgarantie, daher solltest du Wiederholungsversuche in deinem Client implementieren.
Was passiert, wenn ich eine Anfrage stelle, die abgelehnt wird?
Wenn eine Anfrage aufgrund der Inahltsgrenze (sexuelle Inhalte mit Minderjährigen) abgelehnt wird, wirst du für diese Anfrage nicht berechnet. Andere Ablehnungen, z. B. aufgrund der eigenen Beurteilung des Modells, können weiterhin Token-Kosten verursachen. Fehler bei der Verarbeitung sind immer kostenlos.
Kann ich diese API mit dem offiziellen OpenAI SDK verwenden?
Ja, die API ist vollständig OpenAI-kompatibel. Du musst nur die Basis-URL auf https://api.uncensoredai.top/v1 ändern und deinen API-Schlüssel aktualisieren. Die Modell-ID ist 'uncensored'. Alle anderen Parameter wie temperature, top_p und Tools funktionieren wie von OpenAI dokumentiert.
Wie starte ich mit einem Test?
Jedes neue Konto erhält $0,50 kostenloses Testguthaben, das 7 Tage gültig ist. Du kannst dich mit Google oder einer E-Mail-Adresse anmelden, ohne eine Kreditkarte zu benötigen. So kannst du die Latenz, die Antwortqualität und die Streaming-Funktionen der API testen, bevor du Guthaben kaufst.
Dein Schlüssel ist nur ein Formular entfernt
Erstelle ein Konto, kopiere den Schlüssel, ändere die Basis-URL. Das ist die gesamte Einrichtung.