Base URL & Authentifizierung
Um das unzensierte KI-Modell zu nutzen, benötigst du einen gültigen API-Schlüssel. Generiere ihn sofort über Google oder E-Mail auf der Seite API-Schlüssel erhalten. Keine Telefonnummer ist erforderlich, der Schlüssel wird sofort angezeigt.
Setze deine Base URL auf https://api.unhinged.top/v1. Alle Anfragen müssen einen Authorization-Header mit dem Bearer-Schema enthalten. Dieses Setup funktioniert mit jedem OpenAI-kompatiblen SDK. Die API bietet ein unzensiertes LLM online an, optimiert für die direkte Textgenerierung ohne zusätzliche Routing-Schichten.
Erste Anfrage
Sende eine Standard-Chat-Vervollständigungs-Anfrage, um die Integration zu testen. Die Modell-ID ist immer uncensored. Dieser Endpunkt gibt rohen Text ohne Inhaltsablehnungen für die legale erwachsene Nutzung zurück. Wenn du ein Limit erreichst, gibt die API einen klaren Fehlercode zurück.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Diese einfache POST-Anfrage zeigt die Text-zu-Text-Verarbeitung des Dienstes. Du kannst Parameter wie temperature anpassen, um die Kreativität zu steuern. Die Antwort enthält die Token-Nutzung, sodass du die Kosten im Rahmen des transparenten Preismodells nachverfolgen kannst.
Python-SDK-Integration
Verwende das offizielle OpenAI Python SDK, um mit der API zu interagieren. Konfiguriere die Base URL und den API-Schlüssel bei der Client-Initialisierung. Dieser Ansatz ermöglicht es dir, die bestehende Codestruktur beizubehalten und das unzensierte Modell einzusetzen.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Python-Entwickler profitieren von der synchronen Natur dieses Snippets. Es behandelt den Anfragelebenszyklus automatisch. Stelle sicher, dass du Ausnahmen für Ratenlimits oder Authentifizierungsfehler behandelst. Das Modell unterstützt bis zu 100.000 Token im Kontextfenster, was eine umfangreiche Prompt-Historie ermöglicht.
Node-SDK-Integration
Für JavaScript- und TypeScript-Umgebungen bietet das Node SDK eine ähnliche Benutzerfreundlichkeit. Initialisiere den Client mit deiner Base URL und deinem Schlüssel. Dies ermöglicht eine schnelle Prototypentwicklung von KI-Funktionen in Webanwendungen oder Backend-Diensten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Die asynchrone Verarbeitung ist im SDK integriert. Du kannst die Antwort direkt mit await erwarten. Dieses Muster ist ideal für Server-Side-Rendering oder API-Endpunkte, die Modellausgaben an Clients zurückgeben müssen. Denke daran, dass die unzensierte API auf Textgenerierung beschränkt ist; erwarte keine Bild- oder Audiounterstützung in diesem Endpunkt.
Streaming-Antworten
Für geringere Latenz aktiviere das Streaming, indem du stream: true setzt. Die API gibt Server-Sent Events (SSE) zurück. Jeder Chunk enthält Teiltext. Der letzte Chunk enthält die vollständige Token-Nutzungsübersicht.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Streaming ist für chatähnliche Interfaces essenziell, bei denen Nutzer Echtzeit-Feedback erwarten. Verarbeite die choices[0].delta.content-Felder, um die vollständige Antwort zu rekonstruieren. Diese Methode reduziert die Zeit bis zum ersten Token im Vergleich zu vollständigen synchronen Antworten erheblich.
Limits, Fehler & Kontext
Die API erzwingt strenge Kontingente, um die Stabilität zu gewährleisten. Du bist auf 300 Anfragen pro Minute und 8 parallele Anfragen pro Schlüssel begrenzt. Der Anforderungstext darf 8 MB nicht überschreiten. Wenn du diese Grenzen überschreitest, erhältst du einen 429-Fehler.
Authentifizierungsfehler geben 401 zurück, wenn der Schlüssel ungültig ist. Wenn dein Prepaid-Guthaben aufgebraucht ist, gibt die API 402 zurück. Fehler und Ablehnungen sind kostenlos, du wirst also nur für erfolgreiche Token-Nutzung berechnet. Das Kontextfenster unterstützt insgesamt 100.000 Token, mit einem maximalen Output von 32.000 Token pro Anfrage.