URL base y autenticación
Para empezar a usar el modelo de IA sin filtros, necesitas una clave de API válida. Genera una al instante con Google o correo electrónico en la página Obtener clave de API. No se requiere número de teléfono y la clave se muestra inmediatamente.
Establece tu URL base en https://api.unhinged.top/v1. Todas las peticiones deben incluir un encabezado Authorization con el esquema Bearer. Esta configuración funciona con cualquier SDK compatible con OpenAI. La API sirve un único LLM sin censura en línea, optimizado para la generación directa de texto sin capas de enrutamiento adicionales.
Primera petición
Envía una petición estándar de finalización de chat para probar la integración. El ID del modelo es siempre uncensored. Este endpoint devuelve texto sin filtros de contenido para uso adulto lícito. Si superas un límite, la API devuelve un código de error claro.
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Esta sencilla petición POST demuestra la naturaleza directa de entrada y salida de texto del servicio. Puedes ajustar parámetros como temperature para controlar la creatividad. La respuesta incluye el uso de tokens, lo que te ayuda a rastrear los costos frente al modelo de precios transparente.
Integración con SDK Python
Usa el SDK oficial de OpenAI para Python para interactuar con la API. Configura la URL base y la clave de API en la inicialización de tu cliente. Este enfoque te permite mantener la estructura de código existente mientras cambias al modelo sin censura.
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Los desarrolladores de Python se benefician de la naturaleza sincrónica de este fragmento. Maneja el ciclo de vida de la petición automáticamente. Asegúrate de manejar excepciones para límites de peticiones o fallos de autenticación. El modelo admite hasta 100.000 tokens en la ventana de contexto, permitiendo un historial de prompts sustancial.
Integración con SDK Node.js
Para entornos JavaScript y TypeScript, el SDK de Node ofrece una facilidad de uso similar. Inicializa el cliente con tu URL base y clave. Esto permite un prototipado rápido de funciones de IA en aplicaciones web o servicios backend.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);El manejo asíncrono está integrado en el SDK. Puedes esperar la respuesta directamente. Este patrón es ideal para renderizado del lado del servidor o endpoints de API que necesitan devolver salidas del modelo a los clientes. Recuerda que la API sin filtros está limitada a la generación de texto; no esperes soporte de imagen o audio en este endpoint.
Respuestas en streaming
Para experiencias de menor latencia, habilita el streaming estableciendo stream: true. La API devuelve Eventos Enviados por Servidor (SSE). Cada fragmento contiene texto parcial. El fragmento final incluye el resumen completo del uso de tokens.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)El streaming es esencial para interfaces tipo chat donde los usuarios esperan retroalimentación en tiempo real. Analiza los campos choices[0].delta.content para reconstruir la respuesta completa. Este método reduce significativamente el tiempo hasta el primer token en comparación con las respuestas sincrónicas completas.
Límites, errores y contexto
La API aplica cuotas estrictas para garantizar la estabilidad. Estás limitado a 300 peticiones por minuto y 8 peticiones simultáneas por clave. El cuerpo de la petición no debe exceder 8 MB. Si excedes estos límites, recibirás un error 429.
Los errores de autenticación devuelven 401 si la clave no es válida. Si tu crédito prepago se agota, la API devuelve 402. Los errores y las denegaciones son gratuitos, por lo que solo se te cobra por el uso de tokens exitoso. La ventana de contexto admite 100.000 tokens en total, con un máximo de salida de 32.000 tokens por petición.