Bazowy URL i uwierzytelnianie
Aby korzystać z modelu AI, potrzebujesz ważnego klucza API. Wygeneruj go natychmiast przez Google lub e-mail na stronie Pobierz klucz API. Nie potrzebujesz numeru telefonu; klucz jest wyświetlany od razu.
Ustaw swój bazowy URL na https://api.unhinged.top/v1. Wszystkie zapytania muszą zawierać nagłówek Authorization ze schematem Bearer. Konfiguracja ta działa z każdym SDK kompatybilnym z OpenAI. API obsługuje jeden model LLM bez cenzury online, zoptymalizowany pod bezpośrednią generację tekstu bez dodatkowych warstw routingu.
Pierwsze zapytanie
Wyślij standardowe zapytanie o uzupełnienie czatu, aby przetestować integrację. ID modelu to zawsze uncensored. Ten endpoint zwraca surowy tekst bez odrzuceń treści dla prawnego użytku dorosłych. Jeśli przekroczysz limit, API zwróci jasny kod błędu.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'To proste zapytanie POST demonstruje naturę usługi: tekst na wejściu, tekst na wyjściu. Możesz dostosować parametry takie jak temperature, aby kontrolować kreatywność. Odpowiedź zawiera zużycie tokenów, pomagając śledzić koszty w ramach przejrzystego modelu cenowego.
Integracja z Python SDK
Użyj oficjalnego Python SDK OpenAI do interakcji z API. Skonfiguruj bazowy URL i klucz API przy inicjalizacji klienta. Pozwala to zachować strukturę kodu, podmieniając model na ten bez cenzury.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Deweloperzy Pythona czerpią korzyści z synchronicznej natury tego fragmentu kodu. Obsługu on cykl życia zapytania automatycznie. Upewnij się, że obsługujesz wyjątki dla limitów zapytań lub błędów uwierzytelniania. Model obsługuje do 100 000 tokenów w oknie kontekstu, co pozwala na przechowywanie znaczącej historii promptów.
Integracja z Node SDK
W środowiskach JavaScript i TypeScript Node SDK oferuje podobną łatwość użycia. Zainicjuj klienta bazowym URL i kluczem. Pozwala to na szybkie prototypowanie funkcji AI w aplikacjach webowych lub usługach backendowych.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Obsługa asynchroniczna jest wbudowana w SDK. Możesz czekać na odpowiedź bezpośrednio. Ten wzorzec jest idealny do renderowania po stronie serwera lub endpointów API. Pamiętaj, że API bez cenzury ogranicza się do generowania tekstu; nie oczekuj wsparcia dla obrazu czy audio.
Odpowiedzi strumieniowe
Aby zmniejszyć opóźnienia, włącz strumieniowanie, ustawiając stream: true. API zwraca zdarzenia wysłane przez serwer (SSE). Każdy fragment zawiera częściowy tekst. Ostatni fragment zawiera pełne podsumowanie użycia tokenów.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Strumieniowanie jest niezbędne w interfejsach typu czat, gdzie użytkownicy oczekują informacji zwrotnej w czasie rzeczywistym. Parsuj pola choices[0].delta.content, aby zrekonstruować pełną odpowiedź. Ta metoda znacznie skraca czas do pierwszego tokena w porównaniu do pełnych synchronicznych odpowiedzi.
Limity, błędy i kontekst
API narzuca ścisłe limity dla stabilności. Limit to 300 zapytań na minutę i 8 równoległych zapytań na klucz. Ciało zapytania nie może przekraczać 8 MB. Przekroczenie limitów skutkuje błędem 429.
Błędy uwierzytelniania zwracają 401 przy nieprawidłowym kluczu. Jeśli przedpłacony kredyt zostanie wyczerpany, API zwraca 402. Błędy i odrzucenia są darmowe; płacisz tylko za pomyślne użycie tokenów. Okno kontekstu obsługuje 100 000 tokenów, z max outputem 32 000 tokenów na zapytanie.