IT ▾
API LLM senza censura per sviluppatorihttps://api.uncensoredai.top/v1
Ottieni la chiave API

Come integrare l'API Uncensored AI

Integrare un'API AI senza censura ti permette di bypassare i filtri sui contenuti per casi d'uso creativi, per adulti o di ricerca, utilizzando gli SDK standard OpenAI. Questa guida copre la configurazione tecnica, dall'autenticazione allo streaming, utilizzando un endpoint di completamento testo puro che addebita solo per l'effettivo utilizzo dei token.

Aggiornato:

Punti chiave
  • L'API utilizza un endpoint standard compatibile con OpenAI su https://api.uncensoredai.top/v1, che richiede zero modifiche al codice per i client esistenti.
  • I prezzi sono trasparenti: $0,25 per 1M di token di input e $1,00 per 1M di token di output, senza abbonamenti mensili.
  • I pagamenti sono elaborati esclusivamente tramite crypto (USDT o USDC), permettendo ricariche istantanee senza carte di credito.
  • Il modello supporta streaming, modalità JSON e chiamata di funzioni in una finestra di contesto da 100k, ma non offre embeddings o visione.

Perché scegliere un'API Uncensored AI?

La maggior parte dei provider LLM commerciali implementano filtri di sicurezza aggressivi che possono bloccare la scrittura creativa, il roleplay o l'analisi tecnica di argomenti controversi. Un'API AI senza censura rimuove questi rifiuti arbitrari, permettendo al modello di rispondere basandosi sui suoi dati di addestramento piuttosto che su uno strato di policy sui contenuti. Questo è particolarmente utile per gli sviluppatori che costruiscono applicazioni che richiedono output grezzi del modello senza filtri di post-elaborazione.

A differenza degli aggregatori di modelli che instradano le richieste a più fornitori, questo servizio fornisce un singolo modello dedicato. Questo elimina l'imprevedibilità della logica di instradamento e garantisce un comportamento coerente tra le richieste. Il modello è una variante a pesi aperti ottimizzata specificamente per minimizzare i rifiuti per contenuti adulti legali, ricerca di sicurezza e narrazioni di fantasia.

Tuttavia, 'senza censura' non significa illimitato. Il servizio applica comunque un limite rigido ai contenuti sessuali che coinvolgono i minori. Per la maggior parte degli altri casi d'uso, inclusi temi maturi o logica non convenzionale, il modello genererà una risposta. Questo approccio è ideale per gli sviluppatori che vogliono il controllo completo sulla strategia dei contenuti della propria applicazione senza fare affidamento sul gusto del fornitore.

Configurazione dell'ambiente

L'integrazione inizia puntando il tuo SDK compatibile OpenAI all'URL di base corretto. L'endpoint è ospitato su https://api.uncensoredai.top/v1. Questo significa che puoi usare le librerie ufficiali Python o Node.js di OpenAI senza riscrivere la logica del client. Devi solo aggiornare il parametro base_url e fornire la tua chiave API.

Il servizio supporta una finestra di contesto da 100.000 token, significativamente più ampia di molte offerte standard. Ciò consente di gestire cronologie di prompt estese o l'elaborazione di documenti di grandi dimensioni. Tieni presente che il massimo output per richiesta è di 32.000 token. Se non specifichi max_tokens, il valore predefinito è 2.048 token.

  • Compatibilità SDK: Funziona con qualsiasi client che supporta il protocollo OpenAI Chat Completions.
  • Finestra di contesto: 100k token totali (input + output).
  • Output massimo: 32k token per richiesta.

Assicurati che le variabili d'ambiente siano impostate correttamente per evitare problemi di latenza. L'API è pensata per un'integrazione diretta basata sul codice, quindi non c'è un'interfaccia web da imparare. Interagisci con essa esclusivamente tramite richieste HTTP.

Autenticazione e Header

L'autenticazione è gestita tramite l'header standard Authorization. Riceverai una singola chiave API al momento della registrazione. A differenza dei servizi che emettono più chiavi per account, questa piattaforma impone una chiave attiva per account. Se generi una nuova chiave, quella precedente viene immediatamente invalidata.

Per autenticare una richiesta, includi l'header: Authorization: Bearer YOUR_API_KEY. Il servizio fornisce anche un endpoint GET /v1/models, che restituisce le informazioni sui modelli disponibili, incluso l'ID del modello uncensored. Questo è utile per verificare la connettività prima di inviare payload complessi.

Limiti di velocità:

  • 300 richieste al minuto per chiave.
  • 8 richieste parallele contemporanee per chiave.
  • Dimensione massima del corpo della richiesta di 8 MB.

Questi limiti sono generosi per la maggior parte delle applicazioni ma devono essere rispettati per evitare errori 429. Poiché non c'è un piano di abbonamento, questi limiti si applicano uniformemente a tutti gli utenti indipendentemente dal saldo del credito.

Invio della tua prima richiesta di completamento

Una richiesta di base segue il formato standard Chat Completions. Invii un payload JSON con model impostato su uncensored e il tuo array messages. Il servizio restituisce una risposta testuale. Non ci sono endpoint per embeddings, visione o audio: questa è un'API puramente testuale.

Richiesta di esempio:

Il codice seguente mostra una chat completion standard. Sostituisci YOUR_API_KEY con la tua chiave effettiva.

curl https://api.uncensoredai.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta conterrà il testo generato in choices[0].message.content. Gli errori vengono restituiti in formato HTTP standard, permettendoti di gestire i tentativi o i fallimenti in modo elegante. Nota che gli errori non consumano il tuo credito, quindi puoi testare liberamente.

Per gli sviluppatori familiari con OpenAI, l'esperienza è identica. L'unica differenza è l'URL di base e il comportamento del modello riguardo ai filtri sui contenuti. Questa coerenza riduce la curva di apprendimento per i team che utilizzano già strumenti compatibili con OpenAI.

Gestione delle risposte in streaming

Lo streaming è supportato tramite Server-Sent Events (SSE). Questo ti permette di ricevere i token man mano che vengono generati, fornendo una migliore esperienza utente per le risposte lunghe. L'endpoint di streaming è lo stesso di quello non streaming; imposti solo stream: true nella tua richiesta.

Vantaggi dello streaming:

  • Latenza percepita ridotta per gli utenti.
  • Possibilità di visualizzare i risultati parziali in tempo reale.
  • Utilizzo efficiente della memoria poiché i token vengono elaborati in modo incrementale.

L'ultimo frammento di una risposta in streaming include le statistiche sull'utilizzo dei token. Questo è cruciale per l'accuratezza della fatturazione, poiché puoi monitorare esattamente quanti token sono stati consumati. Gli errori durante lo streaming possono risultare in risposte parziali, quindi il tuo client dovrebbe gestire i frammenti incompleti in modo elegante.

Esempio di codice:

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredai.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Assicurati che la tua libreria client gestisca correttamente lo stream SSE. La maggior parte degli SDK moderni lo astrae, ma comprendere il protocollo sottostante aiuta nel debug dei problemi di connessione o negli errori di parsing.

Funzionalità avanzate: modalità JSON e strumenti

L'API supporta output strutturati tramite response_format impostato su {"type": "json_object"}. Questo forza il modello a restituire JSON valido, essenziale per l'integrazione con altri sistemi software. Questa funzionalità è particolarmente utile per l'estrazione di dati o la generazione di file di configurazione.

È supportata anche la chiamata di funzioni. Puoi definire strumenti nella tua richiesta e il modello restituirà chiamate di strumenti nella sua risposta. Questo permette flussi di lavoro complessi in cui l'LLM può attivare azioni esterne. Il parametro tool_choice ti permette di forzare strumenti specifici o lasciare che il modello decida.

Parametri chiave:

  • temperature: Controlla la casualità.
  • top_p: Controlla la diversità.
  • stop: Definisce le sequenze di stop.
  • seed: Per risposte deterministiche.

Queste funzionalità rendono l'API adatta per applicazioni di produzione che richiedono dati strutturati affidabili. Sebbene il modello sia senza censura, aderisce ancora ai vincoli strutturali quando richiesto. Questo equilibrio tra libertà e struttura è un vantaggio chiave per gli sviluppatori che costruiscono agenti complessi.

Monitoraggio dell'utilizzo e dei limiti

L'utilizzo viene tracciato per chiave API. La dashboard mostra il saldo del tuo credito corrente e la cronologia delle richieste recenti. Poiché la fatturazione si basa sull'utilizzo reale dei token, puoi monitorare i tuoi costi in tempo reale. Il servizio non addebita per errori o rifiuti, il che può farti risparmiare denaro durante le fasi di test.

Metriche di utilizzo:

  • Token di input: addebitati a $0,25 per 1M di token.
  • Token di output: addebitati a $1,00 per 1M di token.
  • Errori: gratuiti.

Puoi configurare gli avvisi se la tua libreria client lo supporta, ma il monitoraggio principale avviene tramite la dashboard dell'account. Il limite di 300 richieste al minuto garantisce un utilizzo equo per tutti gli utenti. Se lo superi, riceverai un codice di stato 429.

Per le applicazioni ad alto volume, considera di implementare un backoff esponenziale per i ritentativi. Il servizio è progettato per essere affidabile, ma possono verificarsi problemi di rete o limiti di richieste. Monitorare l'utilizzo dei token ti aiuta a budgettare in modo efficace, soprattutto poiché i crediti non scadono mai.

Gestione dei crediti tramite criptovalute

I pagamenti vengono elaborati esclusivamente tramite criptovalute. Puoi ricaricare il tuo account con USDT (TRC20) o USDC (Base). L'importo minimo di ricarica è di $10, il massimo è di $500. Non ci sono abbonamenti mensili o canoni ricorrenti.

Crediti bonus:

  • Ricarica di $50: +5% di credito bonus.
  • Ricarica di $100: +10% di credito bonus.

I crediti non scadono mai, quindi puoi ricaricare una volta e utilizzarli nel tempo. Questo è ideale per progetti a lungo termine in cui il consumo di token varia. L'assenza di commissioni per l'elaborazione con carta di credito rende le criptovalute un'opzione conveniente per gli sviluppatori che detengono già stablecoin.

Processo di pagamento:

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredai.top/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Per pagare, genera un indirizzo di deposito dalla tua dashboard, invia la criptovaluta e il credito verrà aggiunto automaticamente. I rimborsi non sono disponibili per i crediti, ma errori come addebiti doppi vengono risolti tramite la pagina di Supporto. Questo modello riduce l'attrito per gli sviluppatori globali che potrebbero incontrare restrizioni bancarie.

Domande e risposte

Questa API è adatta per l'uso in produzione?

Sì, l'API è progettata per la produzione con supporto per lo streaming, la modalità JSON e gli strumenti. Ha un limite di 300 richieste al minuto e 8 richieste parallele, che sono sufficienti per la maggior parte delle applicazioni. Tuttavia, non offre un SLA o una garanzia di uptime, quindi dovresti implementare dei ritentativi nel tuo client.

Cosa succede se faccio una richiesta che viene rifiutata?

Se una richiesta viene rifiutata a causa del limite rigido sui contenuti (contenuti sessuali che coinvolgono minori), non ti verrà addebitato nulla per quella richiesta. Altri rifiuti, come quelli basati sul giudizio del modello, potrebbero comunque comportare costi in token. Gli errori di elaborazione sono sempre gratuiti.

Posso usare questa API con l'SDK ufficiale di OpenAI?

Sì, l'API è completamente compatibile con OpenAI. Devi solo modificare l'URL di base in https://api.uncensoredai.top/v1 e aggiornare la tua chiave API. L'ID del modello è 'uncensored'. Tutti gli altri parametri come temperature, top_p e strumenti funzionano come documentato da OpenAI.

Come iniziare con una prova?

Ogni nuovo account riceve $0,50 di credito di prova valido per 7 giorni. Puoi registrarti utilizzando Google o un indirizzo email senza bisogno di una carta di credito. Questo ti permette di testare la latenza dell'API, la qualità delle risposte e le funzionalità di streaming prima di acquistare crediti.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API