基础 URL 与身份验证
要开始使用 Unhinged AI 模型,你需要一个有效的 API 密钥。在获取 API 密钥页面通过 Google 或电子邮件即时生成。无需电话号码,密钥会立即显示。
将基础 URL 设置为https://api.unhinged.top/v1。所有请求必须包含带有Bearer方案的Authorization头。此设置适用于任何兼容 OpenAI 的 SDK。该 API 提供在线无审查 LLM,针对直接文本生成进行了优化,无需额外的路由层。
首次请求
发送标准的聊天完成请求以测试集成。模型 ID 始终为uncensored。该接口返回原始文本,在合法成人用途下不进行内容审查。如果达到限制,API 将返回明确的错误代码。
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'这个简单的 POST 请求展示了服务直接文本输入、文本输出的特性。你可以调整temperature等参数来控制创造性。响应包含 token 使用情况,帮助你根据透明的定价模型跟踪成本。
Python SDK 集成
使用官方 OpenAI Python SDK 与 API 交互。在客户端初始化中配置基础 URL 和 API 密钥。这种方法允许你在保持现有代码结构的同时,替换为无审查模型。
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Python 开发者可以从该代码片段的同步特性中受益。它自动处理请求生命周期。确保处理速率限制或身份验证失败的异常。该模型在上下文窗口中支持多达 100,000 个 token,允许大量的提示词历史。
Node SDK 集成
对于 JavaScript 和 TypeScript 环境,Node SDK 提供了类似的易用性。使用你的基础 URL 和密钥初始化客户端。这允许在 Web 应用程序或后端服务中快速原型化 AI 功能。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);SDK 内置了异步处理。你可以直接等待响应。这种模式非常适合需要向客户端返回模型输出的服务器端渲染或 API 接口。请记住,无审查 API 仅限于文本生成;不要期望在该接口中获得图像或音频支持。
流式响应
为了获得更低的延迟体验,请通过设置stream: true启用流式输出。API 返回服务器发送事件 (SSE)。每个块包含部分文本。最后一个块包含完整的 token 使用摘要。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)流式输出对于期望实时反馈的聊天类界面至关重要。解析choices[0].delta.content字段以重建完整响应。与完整的同步响应相比,此方法显著减少了首个 token 的生成时间。
限制、错误与上下文
API 执行严格的配额以确保稳定性。你被限制为每分钟 300 次请求和每个密钥 8 个并发请求。请求体不得超过 8 MB。如果超出这些限制,你将收到429错误。
如果密钥无效,身份验证错误返回401。如果你的预付额度已用完,API 返回402。错误和拒绝的请求不收费,因此你只为成功的 token 使用付费。上下文窗口总共支持 100,000 个 token,每次请求最大输出 32,000 个 token。