URL Base & Autenticação
Para começar a usar o modelo de IA sem censura, você precisa de uma chave de API válida. Gere uma instantaneamente via Google ou e-mail na página Obter chave de API. Não é necessário número de telefone, e a chave é exibida imediatamente.
Defina sua URL base como https://api.unhinged.top/v1. Todas as requisições devem incluir um cabeçalho Authorization com o esquema Bearer. Esta configuração funciona com qualquer SDK compatível com OpenAI. A API oferece um LLM sem censura online, otimizado para geração direta de texto sem camadas extras de roteamento.
Primeira Requisição
Envie uma requisição padrão de conclusão de chat para testar a integração. O ID do modelo é sempre uncensored. Este endpoint retorna texto bruto sem recusas de conteúdo para uso adulto lícito. Se você atingir um limite, a API retorna um código de erro claro.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Esta simples requisição POST demonstra a natureza direta de entrada e saída de texto do serviço. Você pode ajustar parâmetros como temperature para controlar a criatividade. A resposta inclui o uso de tokens, ajudando você a acompanhar os custos contra o modelo de preços transparente.
Integração com SDK Python
Use o SDK Python oficial do OpenAI para interagir com a API. Configure a URL base e a chave de API na inicialização do seu cliente. Esta abordagem permite que você mantenha a estrutura de código existente enquanto substitui pelo modelo sem censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Desenvolvedores Python se beneficiam da natureza síncrona deste snippet. Ele gerencia o ciclo de vida da requisição automaticamente. Certifique-se de tratar exceções para limites de taxa ou falhas de autenticação. O modelo suporta até 100.000 tokens na janela de contexto, permitindo um histórico de prompts substancial.
Integração com SDK Node.js
Para ambientes JavaScript e TypeScript, o SDK Node oferece facilidade de uso semelhante. Inicialize o cliente com sua URL base e chave. Isso permite a prototipagem rápida de recursos de IA em aplicativos web ou serviços backend.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);O tratamento assíncrono está integrado ao SDK. Você pode aguardar a resposta diretamente. Este padrão é ideal para renderização no lado do servidor ou endpoints de API que precisam retornar saídas do modelo para clientes. Lembre-se de que a API sem censura é limitada à geração de texto; não espere suporte para imagens ou áudio neste endpoint.
Respostas em Streaming
Para experiências com menor latência, ative o streaming definindo stream: true. A API retorna Server-Sent Events (SSE). Cada chunk contém texto parcial. O último chunk inclui o resumo completo do uso de tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)O streaming é essencial para interfaces tipo chat, onde os usuários esperam feedback em tempo real. Analise os campos choices[0].delta.content para reconstruir a resposta completa. Este método reduz significativamente o tempo até o primeiro token em comparação com respostas síncronas completas.
Limites, Erros & Contexto
A API impõe cotas rigorosas para garantir estabilidade. Você está limitado a 300 requisições por minuto e 8 requisições simultâneas por chave. O corpo da requisição não deve exceder 8 MB. Se você exceder esses limites, receberá um erro 429.
Erros de autenticação retornam 401 se a chave for inválida. Se seu crédito pré-pago for esgotado, a API retorna 402. Erros e recusas são gratuitos, então você só é cobrado pelo uso de tokens bem-sucedido. A janela de contexto suporta 100.000 tokens no total, com uma saída máxima de 32.000 tokens por requisição.