기본 URL 및 인증
미친 AI 모델을 사용하려면 유효한 API 키가 필요합니다. API 키 받기 페이지에서 Google 또는 이메일로 즉시 생성하세요. 전화번호는 필요 없으며 키가 즉시 표시됩니다.
기본 URL을 https://api.unhinged.top/v1로 설정하세요. 모든 요청에는 Bearer 스키마가 포함된 Authorization 헤더가 필요합니다. 이 설정은 모든 OpenAI 호환 SDK와 작동합니다. 이 API는 추가 라우팅 레이어 없이 직접 텍스트 생성에 최적화된 무검열 LLM를 제공합니다.
첫 번째 요청
통합 테스트를 위해 표준 채팅 완료 요청을 보내세요. 모델 ID는 항상 uncensored입니다. 이 엔드포인트는 합법적인 성인 용도로 콘텐츠 거부 없이 원시 텍스트를 반환합니다. 제한에 도달하면 API는 명확한 오류 코드를 반환합니다.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'이 간단한 POST 요청은 서비스의 직접적인 텍스트 입력/출력 특성을 보여줍니다. temperature과 같은 매개변수를 조정하여 창의성을 제어할 수 있습니다. 응답에는 토큰 사용량이 포함되어 있어 투명한 가격 모델에 따라 비용을 추적하는 데 도움이 됩니다.
Python SDK 통합
공식 OpenAI Python SDK를 사용하여 API와 상호 작용하세요. 클라이언트 초기화 시 기본 URL과 API 키를 구성하세요. 이 방법은 기존 코드 구조를 유지하면서 무검열 모델로 교체할 수 있게 해줍니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Python 개발자는 이 코드 스니펫의 동기적 특성의 혜택을 받습니다. 요청 수명 주기를 자동으로 처리합니다. 속도 제한 또는 인증 실패에 대한 예외 처리를 수행해야 합니다. 모델은 컨텍스트 창에서 최대 100,000 토큰을 지원하며, 이는 상당한 프롬프트 기록을 허용합니다.
Node SDK 통합
JavaScript 및 TypeScript 환경에서는 Node SDK가 유사한 편의성을 제공합니다. 기본 URL과 키로 클라이언트를 초기화하세요. 이를 통해 웹 애플리케이션 또는 백엔드 서비스에서 AI 기능의 빠른 프로토타이핑이 가능합니다.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);SDK에는 비동기 처리가 내장되어 있습니다. 응답을 직접 await할 수 있습니다. 이 패턴은 모델 출력을 클라이언트에 반환해야 하는 서버 측 렌더링 또는 API 엔드포인트에 이상적입니다. 무검열 API는 텍스트 생성으로 제한되므로 이 엔드포인트에서 이미지나 오디오 지원을 기대하지 마세요.
스트리밍 응답
낮은 지연 시간 경험을 위해 stream: true을 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE)를 반환합니다. 각 청크에는 부분 텍스트가 포함됩니다. 마지막 청크에는 전체 토큰 사용 요약이 포함됩니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)스트리밍은 사용자가 실시간 피드백을 기대하는 채팅 인터페이스에 필수적입니다. choices[0].delta.content 필드를 구문 분석하여 전체 응답을 복원하세요. 이 방법은 전체 동기식 응답에 비해 첫 번째 토큰까지의 시간을 크게 단축합니다.
제한, 오류 및 컨텍스트
API는 안정성을 위해 엄격한 할당량을 적용합니다. 분당 300회 요청 및 키당 동시 8회 요청으로 제한됩니다. 요청 본문은 8 MB를 초과할 수 없습니다. 이러한 제한을 초과하면 429 오류가 발생합니다.
인증 오류는 키가 유효하지 않을 경우 401을 반환합니다. 선불 크레딧이 고갈되면 API는 402을 반환합니다. 오류와 거부는 무료이므로 성공적인 토큰 사용에 대해서만 요금이 부과됩니다. 컨텍스트 창은 총 100,000개의 토큰을 지원하며, 요청당 최대 출력은 32,000개의 토큰입니다.