基礎 URL 與驗證
要開始使用 unhinged ai model,你需要有效的 API 金鑰。在 取得 API 金鑰 頁面透過 Google 或電子郵件即時產生金鑰。無需手機號碼,金鑰會立即顯示。
將基礎 URL 設定為 https://api.unhinged.top/v1。所有請求必須包含 Authorization 標頭,並使用 Bearer 方案。此設定適用於任何 OpenAI 相容的 SDK。該 API 提供一個線上 uncensored LLM,針對直接文字生成進行最佳化,無需額外的路由層。
首次請求
傳送標準的聊天完成請求以測試整合。模型 ID 始終為 uncensored。此端點會回傳原始文字,針對合法成人用途不會拒絕內容。若觸及限制,API 會回傳明確的錯誤碼。
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'這個簡單的 POST 請求展示了服務直接輸入文字、輸出文字的特性。你可以調整temperature等參數來控制創造力。回應包含 token 使用量,幫助你根據透明的定價模式追蹤成本。
Python SDK 整合
使用官方的 OpenAI Python SDK 與 API 互動。在客戶端初始化時設定基礎 URL 和 API 金鑰。這種方法讓你能在保留現有程式碼結構的同時,替換為無審查模型。
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Python 開發者可以從此程式碼片段的同步特性中受益。它會自動處理請求的生命週期。請確保處理速率限制或驗證失敗的例外狀況。該模型在上下文視窗中支援高達 100,000 個 token,允許大量的提示詞歷史記錄。
Node SDK 整合
對於 JavaScript 和 TypeScript 環境,Node SDK 提供了同樣易用的體驗。使用你的基礎 URL 和金鑰初始化客戶端。這允許在網頁應用程式或後端服務中快速開發 AI 功能。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unhinged.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);非同步處理已內建於 SDK 中。你可以直接等待回應。此模式非常適合需要將模型輸出返回給客戶端的伺服器端渲染或 API 端點。請記住,無審查 API 僅限於文字生成;不要期望在此端點獲得影像或音訊支援。
串流回應
為了獲得更低的延遲體驗,請透過設定stream: true來啟用串流。API 會返回伺服器發送的事件 (SSE)。每個區塊包含部分文字。最後一個區塊包含完整的 token 使用摘要。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)串流輸出對於期望即時回饋的聊天介面至關重要。請解析choices[0].delta.content欄位以重建完整回應。與完整的同步回應相比,此方法顯著縮短了首個 token 的時間。
限制、錯誤與上下文
API 執行嚴格的配額以確保穩定性。你每分鐘的請求限制為 300 次,每個金鑰的並行請求限制為 8 個。請求主體不得超過 8 MB。如果你超過這些限制,將會收到429錯誤。
金鑰無效時,驗證錯誤會回傳 401。若預付額度已耗盡,API 會回傳 402。錯誤與拒絕請求皆免費,因此僅對成功的 token 使用收費。上下文視窗總計支援 100,000 個 token,每次請求最多輸出 32,000 個 token。