Basis-URL & Authenticatie
Om het ongeremde AI-model te gebruiken, heb je een geldige API-sleutel nodig. Genereer er direct een via Google of e-mail op de pagina API-sleutel ophalen. Er is geen telefoonnummer nodig en de sleutel wordt direct weergegeven.
Stel je base URL in op https://api.unhinged.top/v1. Alle verzoeken moeten een Authorization header bevatten met het Bearer schema. Deze setup werkt met elke OpenAI-compatible SDK. De API biedt één ongecensureerd LLM online, geoptimaliseerd voor directe tekstgeneratie zonder extra routing-lagen.
Eerste Verzoek
Stuur een standaard verzoek voor chatcompletion om de integratie te testen. De model-ID is altijd uncensored. Dit endpoint retourneert ruwe tekst zonder inhoudsrefusies voor wettelijk volwassen gebruik. Als je een limiet bereikt, retourneert de API een duidelijke foutcode.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Dit eenvoudige POST-verzoek toont de directe tekst-in, tekst-uit aard van de dienst. Je kunt parameters zoals temperature aanpassen om de creativiteit te sturen. De respons bevat token-gebruik, zodat je de kosten kunt volgen tegen het transparante prijsmodel.
Python SDK Integratie
Gebruik de officiële OpenAI Python SDK om met de API te communiceren. Configureer de basis-URL en API-sleutel in je clientinitialisatie. Deze aanpak stelt je in staat de bestaande codestructuur te behouden terwijl je het ongecensureerde model gebruikt.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Python-ontwikkelaars profiteren van de synchronische aard van deze snippet. Het verwerkt de verzoeklevenscyclus automatisch. Zorg dat je uitzonderingen afhandelt voor rate limits of authenticatiefouten. Het model ondersteunt tot 100.000 tokens in het contextvenster, waardoor je uitgebreide promptgeschiedenis kunt bijhouden.
Node SDK Integratie
Voor JavaScript- en TypeScript-omgevingen biedt de Node SDK vergelijkbaar gebruiksgemak. Initialiseer de client met je basis-URL en sleutel. Dit stelt je in staat snel prototypes van AI-functies te bouwen in webapplicaties of backend-diensten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Asynchrone afhandeling is ingebouwd in de SDK. Je kunt direct wachten op de respons. Dit patroon is ideaal voor server-side rendering of API-endpoints die modeloutputs aan clients moeten retourneren. Onthoud dat de ongecensureerde API beperkt is tot tekstgeneratie; verwacht geen ondersteuning voor afbeeldingen of audio in dit endpoint.
Streaming Responsen
Voor ervaringen met lagere latentie, activeer streaming door stream: true in te stellen. De API retourneert Server-Sent Events (SSE). Elke chunk bevat gedeeltelijke tekst. De laatste chunk bevat de volledige samenvatting van tokengebruik.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Streaming is essentieel voor chat-achtige interfaces waar gebruikers realtime feedback verwachten. Parse de choices[0].delta.content-velden om de volledige respons te reconstrueren. Deze methode vermindert de tijd tot eerste token aanzienlijk in vergelijking met volledige synchronische responsen.
Limieten, Fouten & Context
De API handhaaft strikte quota's om stabiliteit te garanderen. Je bent beperkt tot 300 verzoeken per minuut en 8 gelijktijdige verzoeken per sleutel. Het verzoeklichaam mag niet groter zijn dan 8 MB. Als je deze limieten overschrijdt, ontvang je een 429 fout.
Authenticatiefouten retourneren 401 als de sleutel ongeldig is. Als je prepaid tegoed op is, retourneert de API 402. Fouten en refusals zijn gratis, dus je betaalt alleen voor succesvol tokengebruik. Het contextvenster ondersteunt in totaal 100.000 tokens, met een maximale uitvoer van 32.000 tokens per verzoek.