ポイント早わかり
- プライベート推論:モデルは自前の GPU/サーバーで動作。
- OpenAI 互換 API で、設定はクラウド API の接続とほぼ同じ。
- Hugging Face 上の多数のオープンソースモデルを使え、デプロイは自分で掌握。
接続方法
まず TGI で OpenAI 互換の推論エンドポイントを立て、選んだ HF モデルを読み込みます。次に隠界のモデル設定で OpenAI 互換プロバイダーを選び、base URL を自分の TGI アドレスに向け、対応するキー(あれば)を入力すれば、既定にもキャラクター単位の指定にもできます。
こんな人に
GPU リソースがあり、Hugging Face エコシステムを深く使い、あるいは推論一式をプライベート化したいチームや上級ユーザー向け。隠界のセルフホストと組み合わせれば、モデルもデータも自分のインフラに留まります。
重要な事実
- 接続方式
- OpenAI 互換エンドポイント(base URL)
- 課金
- セルフホスト、第三者 API 費用なし
- 適する用途
- プライベート推論 / HF エコシステムのモデル
- データの流れ
- 自前のインフラ内に留まる
試してみますか?
ブラウザですぐ使えます。クレジットカード登録もインストールも不要。