URL di base e Autenticazione
Per iniziare a usare il modello AI senza censura, hai bisogno di una chiave API valida. Generane una istantaneamente tramite Google o email nella pagina Ottieni chiave API. Non serve il numero di telefono e la chiave viene visualizzata immediatamente.
Imposta il tuo URL base su https://api.unhinged.top/v1. Tutte le richieste devono includere un'intestazione Authorization con lo schema Bearer. Questa configurazione funziona con qualsiasi SDK compatibile con OpenAI. L'API serve un LLM senza censura online, ottimizzato per la generazione diretta di testo senza livelli di instradamento aggiuntivi.
Prima Richiesta
Invia una richiesta standard di completamento chat per testare l'integrazione. L'ID del modello è sempre uncensored. Questo endpoint restituisce testo grezzo senza rifiuti di contenuto per uso adulto legale. Se raggiungi un limite, l'API restituisce un codice di errore chiaro.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Questa semplice richiesta POST dimostra la natura diretta testo-in, testo-out del servizio. Puoi regolare parametri come temperature per controllare la creatività. La risposta include l'utilizzo dei token, aiutandoti a tracciare i costi rispetto al modello di prezzi trasparente.
Integrazione SDK Python
Usa l'SDK Python ufficiale di OpenAI per interagire con l'API. Configura l'URL di base e la chiave API nell'inizializzazione del client. Questo approccio ti permette di mantenere la struttura del codice esistente mentre sostituisci il modello senza censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Gli sviluppatori Python traggono beneficio dalla natura sincrona di questo snippet. Gestisce automaticamente il ciclo di vita della richiesta. Assicurati di gestire le eccezioni per i limiti di richiesta o i fallimenti di autenticazione. Il modello supporta fino a 100.000 token nella finestra di contesto, consentendo una cronologia di prompt sostanziale.
Integrazione SDK Node.js
Per gli ambienti JavaScript e TypeScript, l'SDK Node offre una facilità d'uso simile. Inizializza il client con il tuo URL di base e chiave. Questo permette un prototipaggio rapido di funzionalità AI nelle applicazioni web o nei servizi backend.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);La gestione asincrona è integrata nell'SDK. Puoi attendere direttamente la risposta. Questo pattern è ideale per il rendering lato server o per gli endpoint API che devono restituire le uscite del modello ai client. Ricorda che l'API senza censura è limitata alla generazione di testo; non aspettarti supporto per immagini o audio in questo endpoint.
Risposte in Streaming
Per esperienze con latenza inferiore, abilita lo streaming impostando stream: true. L'API restituisce Server-Sent Events (SSE). Ogni chunk contiene testo parziale. L'ultimo chunk include il riepilogo completo dell'utilizzo dei token.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Lo streaming è essenziale per le interfacce di tipo chat dove gli utenti si aspettano feedback in tempo reale. Analizza i campi choices[0].delta.content per ricostruire la risposta completa. Questo metodo riduce significativamente il tempo al primo token rispetto alle risposte complete sincrone.
Limiti, Errori e Contesto
L'API impone quote rigorose per garantire la stabilità. Sei limitato a 300 richieste al minuto e 8 richieste parallele per chiave. Il corpo della richiesta non deve superare 8 MB. Se superi questi limiti, riceverai un errore 429.
Gli errori di autenticazione restituiscono 401 se la chiave non è valida. Se il tuo credito prepagato è esaurito, l'API restituisce 402. Errori e rifiuti sono gratuiti, quindi vieni addebitato solo per l'utilizzo effettivo dei token. La finestra di contesto supporta 100.000 token in totale, con un output massimo di 32.000 token per richiesta.