メインコンテンツへスキップ
Enclave
モデル連携

隠界で Groq を使う(超低遅延の推論)

隠界(Enclave)は BYOK で Groq に対応します。Groq API キーを入力すれば、Groq がホストするオープンソースモデル(Llama 系など)を隠界キャラクターのベースに使えます。Groq は推論遅延が極めて低いことで知られ、遅延に敏感なリアルタイム会話に最適です。隠界は枠を転売せず、Groq の公式料金で課金します。

最終確認:

一言で言うと

Groq API キーを入力すれば、隠界のキャラクターが Groq の超低遅延推論で応答し、より「即レス」に近づきます。

ポイント早わかり

  • BYOK:自分の Groq アカウントと枠を使用。
  • 超低遅延の推論で、リアルタイムかつ高頻度の会話キャラクターに最適。
  • 他のプロバイダーと併用可能:速さが要るキャラクターは Groq、安定重視は別へ。

接続方法

モデル設定で Groq(OpenAI 互換プロバイダー)を選び、API キーを入力し、base URL を Groq のエンドポイントに向ければ、既定にもキャラクター単位の指定にもできます。隠界は複数プロバイダーの併存を許すので、遅延に敏感なキャラクターだけ Groq に切り替えられます。

こんな人に

応答速度を重視し、会話の「もたつき」をなくしたいユーザー向け。特に音声の寄り添いやリアルタイムのグループチャットなど遅延に敏感な場面に。隠界の記憶と能動性と組み合わせれば、速さと「覚えていること」を両立できます。

重要な事実

接続方式
BYOK(OpenAI 互換エンドポイント)
課金
Groq の公式料金で課金、隠界の上乗せなし
特徴
超低遅延の推論
データの流れ
セルフホスト時はあなたのインスタンスから直接

試してみますか?

ブラウザですぐ使えます。クレジットカード登録もインストールも不要。

関連コンテンツ

他のモデルを接続

隠界で Groq を使う(超低遅延の推論) · Enclave