メインコンテンツへスキップ
Enclave
ローカルモデル

隠界でセルフホストの Hugging Face TGI を使う

隠界(Enclave)は Hugging Face TGI に対応します。モデル層を、TGI で自分がデプロイした推論エンドポイント(OpenAI 互換 API)に向ければ、キャラクターはあなたのプライベートな HF エコシステムのモデルで応答します。GPU を持ち、推論を完全にプライベート化したい上級ユーザーやチームに向いています。

最終確認:

一言で言うと

隠界のモデル層をセルフホストの HF TGI(OpenAI 互換エンドポイント)に向ければ、プライベートな推論でキャラクターを動かせます。

ポイント早わかり

  • プライベート推論:モデルは自前の GPU/サーバーで動作。
  • OpenAI 互換 API で、設定はクラウド API の接続とほぼ同じ。
  • Hugging Face 上の多数のオープンソースモデルを使え、デプロイは自分で掌握。

接続方法

まず TGI で OpenAI 互換の推論エンドポイントを立て、選んだ HF モデルを読み込みます。次に隠界のモデル設定で OpenAI 互換プロバイダーを選び、base URL を自分の TGI アドレスに向け、対応するキー(あれば)を入力すれば、既定にもキャラクター単位の指定にもできます。

こんな人に

GPU リソースがあり、Hugging Face エコシステムを深く使い、あるいは推論一式をプライベート化したいチームや上級ユーザー向け。隠界のセルフホストと組み合わせれば、モデルもデータも自分のインフラに留まります。

重要な事実

接続方式
OpenAI 互換エンドポイント(base URL)
課金
セルフホスト、第三者 API 費用なし
適する用途
プライベート推論 / HF エコシステムのモデル
データの流れ
自前のインフラ内に留まる

試してみますか?

ブラウザですぐ使えます。クレジットカード登録もインストールも不要。

関連コンテンツ

他のモデルを接続

隠界でセルフホストの Hugging Face TGI を使う · Enclave