NL ▾

unhinged.topGehoste ongecensureerde API voor ontwikkelaars

Het Unhinged AI-model: Een kosten- en afwegingsanalyse

Het Unhinged AI-model biedt een naadloze, ongecensureerde API-alternatief voor ontwikkelaars die ruwe tekstuitvoer nodig hebben zonder inhoudsfilters of abonnementsmuren. Door een contextvenster van 100k tokens te combineren met transparante tokenprijzen en OpenAI SDK-compatibiliteit, fungeert het als een praktische hulpmiddel voor specifieke toepassingsgebieden waar standaardmodellen wettelijke volwassen of controversiële onderwerpen weigeren.

Bijgewerkt

Belangrijkste punten

  1. De API biedt één ongecensureerd model met een contextvenster van 100k tokens, waardoor inhoudsweigeringen voor wettelijke volwassen inhoud worden geëlimineerd.
  2. Prijzen zijn transparant: $0,25/1M inputtokens en $1,00/1M outputtokens, met prepaid crypto tegoed dat nooit vervalt.
  3. Integratie is onmiddellijk via OpenAI-compatibele endpoints, met ondersteuning voor streaming, JSON-modus en function calling.
  4. De dienst is strikt tekstgebaseerd, alleen crypto voor opwaarderingen, en ontworpen voor ontwikkelaars in plaats van eindgebruikers.

Wat is het Unhinged AI-model?

Het unhinged ai-model is een large language model gehost als een standalone API-endpoint. In tegenstelling tot multi-vendor platforms die verzoeken door verschillende propriëtaire systemen routeren, draait deze service één open-weight model dat specifiek is afgestemd om inhoudsweigeringen te minimaliseren. Het is ontworpen voor ontwikkelaars die directe toegang willen tot modeluitvoer zonder de guardrails die standaard commerciële APIs opleggen aan volwassen, controversiële of niche-onderwerpen.

Het model claimt niet GPT, Claude of enig ander product van een grote leverancier te zijn. Het is een onafhankelijke open-weight oplossing die wordt geleverd via dedicated infrastructuur. De primaire waardepropositie is betrouwbaarheid en gebrek aan censuur voor wettelijke use cases. Wanneer je een prompt verzendt, ontvang je een ruwe respons. Er worden geen verborgen filters toegepast na de generatie, noch zijn er login-walls die programmatische toegang onderbreken. Dit maakt het bijzonder nuttig voor toepassingen waar voorspelbare, ongefilterde tekstgeneratie belangrijker is dan toegang tot meerdere verschillende modelarchitecturen.

Waarom Gehost in plaats van Lokaal?

Een ongecensureerd lokaal llm draaien vereist aanzienlijke hardware-investeringen, specifiek high-end GPUs met voldoende VRAM. Hoewel lokale implementatie gegevensprivacy en nul latentie voor inferentie biedt, vraagt het om voortdurend onderhoud, stroom en hardware-upgrades. Voor veel ontwikkelaars is de overhead van het beheren van GPU-clusters onnodig wanneer het primaire doel simpelweg is om tekstuitvoer te krijgen.

Een gehoste API zoals deze verlicht de hardwarelast. Je ruilt de controle van lokale inferentie in voor gemak en schaalbaarheid. Het gehoste model is altijd beschikbaar, geschaald om gelijktijdige verzoeken af te handelen, en wordt bijgewerkt door de provider. Dit is ideaal voor prototypes, startups of toepassingen die variabele verkeersbelasting ervaren. Je hoeft je geen zorgen te maken over GPU-beschikbaarheid of driver-upgrades. De afweging is dat je afhankelijk bent van de uptime en prijsstructuur van de provider, maar voor de meeste use cases weegt de operationele eenvoud zwaarder dan de voordelen van lokale hardware.

Prestaties: 100k Contextvenster

Een kernfunctie van deze API is het 100.000-token contextvenster. Dit stelt je in staat grote documenten, uitgebreide codebases of lange conversatiegeschieden in één verzoek te versturen. De meeste standaard modellen capen context op 8k of 32k tokens, wat ontwikkelaars dwingt complexe chunking-strategieën te implementeren. Met 100k tokens kun je volledige handleidingen of lange codebestanden verwerken en coherente antwoorden krijgen zonder eerdere context te verliezen.

De maximale uitvoerlengte is 32.000 tokens per verzoek, voldoende voor lange essays, codeblokken of gedetailleerde uitleg. Als je max_tokens niet specificeert, is de standaardwaarde 2.048 tokens. Dit is cruciaal voor ontwikkelaars; het niet instellen kan leiden tot afgekapt antwoord bij langere taken. Het grote contextvenster maakt deze ongecensureerde modellen optie geschikt voor RAG-systemen waar volledige context essentieel is voor nauwkeurigheid.

Kostenanalyse: Tokens vs. Berekening

Prijzen voor deze API zijn strikt gebruiksgestuurd. Inputtokens kosten $0,25 per miljoen, en outputtokens kosten $1,00 per miljoen. Dit is een standaard prijsstructuur voor gehoste LLM API's, maar de transparantie is opvallend. Er zijn geen maandelijkse abonnementen, geen getrapte prijzen en geen verborgen kosten. Fouten en weigeringen (met uitzondering van de harde limiet voor minderjarinhoud) zijn gratis, wat betekent dat je alleen betaalt voor geldige voltooiingen.

Bij het vergelijken van kosten, houd er rekening mee dat lokale inferatie een hoge vaste kost heeft. Een enkele GPU kan $10.000+ kosten en verbruikt aanzienlijke stroom. Voor sporadisch gebruik is een gehoste API bijna altijd goedkoper. Zelfs voor hoogvolume gebruik blijft de tokenkosten voorspelbaar. Je kunt tegoed vooruit betalen, dat nooit vervalt, zodat je budgetteren kunt op basis van daadwerkelijk verbruik. Dit model elimineert het risico op betalen voor inactieve capaciteit, wat een veelvoorkomend probleem is bij reserved instance prijzen in cloud computing.

API-compatibiliteit: OpenAI SDK

De API is volledig compatibel met de officiële OpenAI SDK's. Je kunt dezelfde codestructuur gebruiken als voor GPT-4, door alleen de basis-URL en API-sleutel aan te passen. De basis-URL is https://api.unhinged.top/v1. Het endpoint voor chatvoltooiingen is POST /v1/chat/completions, en modelinformatie is beschikbaar via GET /v1/models. Dit vermindert de leercurve aanzienlijk voor ontwikkelaars die bekend zijn met het OpenAI-ecosysteem.

from openai import OpenAI

client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Je kunt dit met minimale codeaanpassingen in je bestaande pipelines integreren. De te gebruiken model-ID is uncensored. Deze compatibiliteit geldt voor elke client die het OpenAI-formaat ondersteunt, inclusief bibliotheken voor Node.js, Go en Rust. Deze universaliteit betekent dat je niet aan een propriëtaire client bent gebonden. Je kunt dit endpoint met enkele regelwijzigingen in je applicatie plaatsen, wat het een echte drop-in vervanging maakt voor het testen van ongecensureerde uitvoer.

Functieset: Tools & Streaming

Ondanks dat het een single-model service is, ondersteunt de API moderne LLM-functies. Streaming is ingeschakeld via Server-Sent Events (SSE), waardoor je tokens in realtime kunt ontvangen. Dit is cruciaal voor gebruikersinterfaces die tekst weergeven terwijl deze wordt gegenereerd. De laatste chunk van een stream bevat tokengebruiksstatistieken, zodat je kosten nauwkeurig kunt bijhouden in je applicatie.

Function calling wordt ondersteund, waardoor het model gestructureerde JSON kan genereren voor toolgebruik. Je kunt ook JSON-modus afdwingen met response_format: json_object voor betrouwbare gegevensextractie. Parameters zoals temperature, top_p, stop en seed zijn beschikbaar voor het afstellen van het uitvoergedrag. Deze functies maken de API geschikt voor het bouwen van agentic workflows, niet alleen voor eenvoudige chatbots. De mogelijkheid om te streamen en functies tegelijkertijd aan te roepen, biedt de flexibiliteit die nodig is voor complexe toepassingen.

Beperkingen: Enkelmodelarchitectuur

De primaire beperking is dat je toegang hebt tot slechts één model. Je kunt niet kiezen tussen verschillende architecturen of afwegingen tussen snelheid en kwaliteit. Als de prestaties van dit specifieke model niet aan je behoeften voldoen, kun je niet schakelen naar een andere variant binnen dezelfde API. Dit is een afweging voor eenvoud. Multi-model platforms bieden keuze, maar introduceren vaak complexiteit in routing en prijzen.

Bovendien is de API alleen tekst. Er zijn geen embeddings, image generatie, audio of video mogelijkheden. Het ondersteunt geen fine-tuning of search. Als je applicatie multimodale inputs vereist, moet je deze API combineren met andere diensten. De service is ook strikt voor ontwikkelaars; er is geen chatinterface voor eindgebruikers. Deze focus zorgt ervoor dat de infrastructuur is geoptimaliseerd voor API-verzoeken in plaats van web UI-prestaties, wat resulteert in een stabieler endpoint voor programmatisch gebruik.

Betalingsmechanica: Alleen Crypto

Betalingen worden uitsluitend geaccepteerd via cryptocurrency. Je kunt je account opwaarderen met USDT (TRC20) of USDC (Base). Het minimale top-up bedrag is $10, en het maximum is $500 per transactie. Er is een bonusstructuur: +5% tegoed voor top-ups van $50 of meer, en +10% voor $100 of meer. Deze bonus wordt toegepast op je prepaid saldo.

curl https://api.unhinged.top/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Geen creditcards, PayPal of bankoverschrijvingen worden geaccepteerd. Dit spreekt tot gebruikers die de voorkeur geven aan privacy of traditionele bankkosten willen vermijden. Prepaid tegoed vervalt nooit, dus je kunt een keer opwaarderen en het over een langere periode gebruiken. Nieuwe accounts ontvangen $0,50 aan trial tegoed, geldig voor 7 dagen, zonder kaart vereist. Deze lage instapdrempel stelt ontwikkelaars in staat de API grondig te testen voordat ze zich committeren aan een grotere aankoop. Restituties worden niet uitgegeven voor tegoed, maar fouten zoals dubbele charges worden opgelost via support.

01

Vragen en antwoorden

Is het Unhinged-model hetzelfde als GPT-4 of Claude?

Nee. Het Unhinged-model is een onafhankelijk open-weight model. Het is geen doorverkoop van GPT, Claude, Gemini of enig ander model van een andere leverancier. Het is een aparte architectuur die is getraind om inhoudsweigeringen voor wettelijke volwassen en controversiële onderwerpen te minimaliseren.

Hoe integreer ik de API in mijn project?

Je kunt elke OpenAI-compatible SDK gebruiken. Stel de basis-URL in op https://api.unhinged.top/v1 en gebruik de model-ID 'uncensored'. De API ondersteunt standaard endpoints zoals /v1/chat/completions en biedt streaming, JSON-modus en function calling.

Wat gebeurt er als ik een verzoek doe dat een fout oplevert?

Fouten zijn gratis. Je betaalt alleen voor succesvol gebruik van tokens. Als een verzoek faalt door rate limits of ongeldige parameters, word je niet in rekening gebracht. Als een verzoek echter wordt geweigerd vanwege de harde limiet voor seksuele inhoud met minderjarigen, kan het alsnog als een verzoek worden geteld afhankelijk van de implementatie, maar over het algemeen worden weigeringen niet in rekening gebracht.

Kan ik deze API gebruiken voor commerciële toepassingen?

Ja. Er zijn geen beperkingen op commercieel gebruik. Het model is ongecensureerd, wat betekent dat het geen wettelijke volwassen inhoud weigert. Dit maakt het geschikt voor toepassingen waar standaard modellen bepaalde soorten creatieve of volwassen inhoud zouden blokkeren.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, wijzig de basis-URL. Dat is de hele installatie.

API-sleutel ophalenLees de documentatie