Unhinged AIモデルとは何ですか?
アンヒンガードAIモデルは、スタンドアロンのAPIエンドポイントとしてホストされる大規模言語モデルです。リクエストを様々な独自システムにルーティングするマルチベンダープラットフォームとは異なり、このサービスはコンテンツ拒否を最小限に抑えるために特別にチューニングされた単一のオープンウェイトモデルを実行します。これは、標準的な商用APIが大人向け、論争的、またはニッチなトピックに課すガードレールなしでモデル出力に直接アクセスしたい開発者向けに設計されています。
このモデルはGPT、Claude、またはその他の主要ベンダーの製品であると主張していません。専用インフラストラクチャから提供される独立したオープンウェイトソリューションです。主な価値提案は、法的なユースケースに対する信頼性と検閲の欠如です。プロンプトを送信すると、生のレスポンスが返されます。生成後に隠れたフィルターが適用されることも、プログラムによるアクセスを妨げるログインの壁があることもありません。これは、複数の異なるモデルアーキテクチャへのアクセスよりも、予測可能でフィルターなしのテキスト生成が重要であるアプリケーションに特に役立ちます。
ローカルよりホストを選ぶ理由
無検閲ローカルLLMを実行するには、特定のハイエンドGPUに豊富なVRAMを備えた、大きなハードウェア投資が必要です。ローカルデプロイメントはデータプライバシーと推論のゼロレイテンシを提供しますが、継続的なメンテナンス、電力、ハードウェアアップグレードが必要です。多くの開発者にとって、主な目的が単にテキスト出力を得ることである場合、GPUクラスターの管理オーバーヘッドは不要です。
このようなホストAPIはハードウェアの負担を軽減します。ローカル推論の制御を利便性とスケーラビリティと交換します。ホストモデルは常に利用可能で、同時リクエストを処理するようにスケーリングされ、プロバイダーによって更新されます。これは、プロトタイプ、スタートアップ、または変動するトラフィック負荷を経験するアプリケーションに最適です。GPUの利用可能性やドライバーのアップデートを心配する必要はありません。トレードオフは、プロバイダーの稼働率と価格構造に依存することですが、ほとんどのユースケースでは、運用の単純さがローカルハードウェアの利点を上回ります。
パフォーマンス:100kコンテキストウィンドウ
このAPIの主な機能の1つは、100,000トークンのコンテキストウィンドウです。これにより、大きなドキュメント、広大なコードベース、または長い会話履歴を1つのリクエストで渡すことができます。ほとんどの標準モデルはコンテキストを8kまたは32kトークンに制限するため、開発者は複雑なチャンキング戦略を実装する必要があります。10万トークンを使用することで、マニュアル全体や長いコードファイルを取り込み、以前のコンテキストを失うことなく一貫した応答を得ることができます。
最大出力長は1リクエストあたり32,000トークンで、長いエッセイ、コードブロック、または詳細な説明の生成に十分です。max_tokensを指定しない場合、デフォルトは2,048トークンです。これは出力長を管理する開発者にとって重要な詳細です。このパラメータを設定しないと、長いタスクで応答が切り捨てられる可能性があります。大きなコンテキストウィンドウにより、この無検閲モデルオプションは、完全なコンテキストの保持が正確性に不可欠なRAG(検索拡張生成)システムにとって実現可能になります。
コスト分析:トークン vs コンピューティング
このAPIの料金は厳密に使用量ベースです。入力トークンは100万あたり$0.25、出力トークンは100万あたり$1.00です。これはホストされたLLM APIの標準的な料金構造ですが、その透明性は注目すべきものです。月額サブスクリプション、段階的な料金、隠れた料金はありません。エラーと拒否(未成年コンテンツのハード制限を除く)は無料であり、有効な補完に対してのみ課金されます。
コストを比較する際は、ローカル推論には高い固定コストがかかることに注意してください。単一のGPUは10,000ドル以上かかり、大量の電力を消費します。散発的な利用では、ホストされたAPIの方がほぼ確実に安価です。大量の利用であっても、トークンあたりのコストは予測可能です。前払いクレジットを利用でき、期限切れにならないため、実際の消費に基づいて予算を組むことができます。このモデルは、クラウドコンピューティングの予約インスタンス価格でよく見られるアイドル容量への支払いリスクを排除します。
API互換性:OpenAI SDK
APIは公式のOpenAI SDKと完全に互換性があります。ベースURLとAPIキーを変更するだけで、GPT-4と同じコード構造を使用できます。ベースURLはhttps://api.unhinged.top/v1です。チャット補完のエンドポイントはPOST /v1/chat/completions、モデル情報はGET /v1/modelsで利用可能です。これは、OpenAIエコシステムにすでに精通している開発者の学習曲線を大幅に軽減します。
from openai import OpenAI
client = OpenAI(base_url="https://api.unhinged.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)既存のパイプラインに最小限のコード変更で統合できます。使用するモデルIDはuncensoredです。この互換性は、Node.js、Go、Rustのライブラリを含むOpenAI形式をサポートするすべてのクライアントに拡張されます。この普遍性により、独自のプロプライエタリクライアントにロックインされません。数行の変更でこのエンドポイントをアプリケーションに挿入できるため、無検閲出力のテストには真のドロインプレースメントとなります。
機能セット:ツールとストリーミング
単一モデルサービスにもかかわらず、APIは最新のLLM機能をサポートしています。ストリーミングはServer-Sent Events(SSE)を介して有効になり、リアルタイムでトークンを受け取ることができます。これは、テキストが生成される際に表示するユーザーインターフェースにとって重要です。ストリームの最終チャンクにはトークン使用統計が含まれているため、アプリケーションでコストを正確に追跡できます。
関数呼び出しがサポートされており、モデルはツール使用のために構造化されたJSONを生成できます。response_format: json_objectを使用してJSONモードを強制することもでき、信頼性の高いデータ抽出が可能です。temperature、top_p、stop、seedなどのパラメータを使用して、出力動作を微調整できます。これらの機能により、このAPIは単なるチャットボットだけでなく、エージェントワークフローの構築にも適しています。ストリーミングと関数呼び出しを同時に実行する機能により、複雑なアプリケーションに必要な柔軟性が提供されます。
制限:単一モデルアーキテクチャ
主な制限は、1つのモデルにのみアクセスできることです。異なるアーキテクチャ間で選択したり、速度と品質のトレードオフを行ったりすることはできません。この特定のモデルのパフォーマンスがニーズを満たさない場合、同じAPI内で別のバリアントに切り替えることはできません。これは単純さのためのトレードオフです。マルチモデルプラットフォームは選択を提供しますが、ルーティングと価格設定に複雑さをもたらすことが多いです。
さらに、APIはテキストのみです。埋め込み、画像生成、オーディオ、ビデオ機能はありません。ファインチューニングや検索もサポートしていません。マルチモーダル入力を必要とするアプリケーションの場合、このAPIを他のサービスと組み合わせる必要があります。このサービスは厳密に開発者向けであり、ユーザー向けチャットインターフェースはありません。この焦点により、インフラストラクチャはWeb UIパフォーマンスではなくAPIリクエストに最適化され、プログラムmaticな使用に対してより安定したエンドポイントが提供されます。
支払いメカニクス:暗号通貨のみ
支払いは暗号通貨のみで受け付けられます。USDT(TRC20)またはUSDC(Base)を使用してアカウントにチャージできます。最小チャージ額は$10で、1回あたりの最大額は$500です。ボーナス構造があります:$50以上のチャージで+5%のクレジット、$100以上で+10%です。このボーナスは前払い残高に適用されます。
curl https://api.unhinged.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'クレジットカード、PayPal、銀行振込は受け付けません。これはプライバシーを重視するユーザーや、従来の銀行手数料を避けたいユーザーにアピールします。前払いクレジットは期限切れにならないため、一度チャージして長期にわたって使用できます。新しいアカウントには、カード不要で7日間有効な$0.50の無料トライアルクレジットが付与されます。この低い参入障壁により、開発者はより大きな購入を行う前にAPIを徹底的にテストできます。クレジットに対する返金は発行されませんが、二重請求などのエラーはサポートを通じて解決されます。