핵심 요약
- Ollama를 사용하면 자기 머신에서 오픈소스 대형 모델을 실행할 수 있고, 추론이 네트워크 밖으로 나가지 않습니다.
- Enclave는 모델 위에 기억, 능동성, 여러 전문가, 그리고 산출물을 채워 줍니다.
- 둘을 합치면 = 데이터가 머신을 벗어나지 않는, 프라이버시 우선의 AI 컴패니언.
왜 AI 컴패니언을 로컬에서 실행하는가
AI 컴패니언은 수많은 사적인 대화를 수반합니다. 이를 클라우드에 맡기면 프라이버시는 약관에만 의존하게 됩니다. 로컬에서 모델을 실행하면 추론이 자기 머신에서 완결되고 데이터가 네트워크 밖으로 나가지 않습니다——이것이야말로 프라이버시 우선 사용자가 가장 중시하는 점입니다. Ollama는 오픈소스 대형 모델을 로컬에서 실행하는 일을 간단하게 만듭니다.
Ollama가 담당하는 것, Enclave가 담당하는 것
Ollama는 모델을 로컬에서 효율적으로 구동하는 '모델 런타임'이지만, 그 자체로는 기억·능동성·다중 캐릭터를 제공하지 않습니다. Enclave는 모델 위에 구축된 '세계'로, 장기 기억·능동적 후속 조치·여러 전문가 레지던트·실제 산출물을 제공합니다. Ollama를 Enclave의 로컬 모델 백엔드로 사용하면 서로 역할을 나눠 하나의 완전한 경험으로 보완됩니다.
구축하는 방법
먼저 로컬에서 Ollama를 실행하고 모델을 받은 다음, Enclave를 셀프 호스팅하고 모델 백엔드를 로컬 Ollama 엔드포인트로 지정하면 됩니다 — 자세한 내용은 셀프 호스팅 튜토리얼과 하이브리드 모델 설정을 참고하세요. 전부 로컬로 두고 외부 동기화를 끄면, 데이터가 자기 기기에만 남는 완전 오프라인 AI 컴패니언 세계를 갖게 됩니다.
자주 묻는 질문
Enclave는 어떤 대형 언어 모델을 지원하나요?
Enclave의 모델 계층은 완전히 교체 가능합니다. OpenAI, Anthropic, Google, DeepSeek는 물론 로컬 Ollama / vLLM도 모두 구성할 수 있습니다. 캐릭터마다 다른 모델을 사용할 수도 있어 상황과 비용에 따라 자유롭게 배분합니다.Enclave를 완전히 오프라인으로 실행할 수 있나요?
가능합니다. 모델 계층을 로컬 Ollama / vLLM으로 교체하고 현실 세계 동기화를 끄면, 시스템 전체가 외부로 어떤 요청도 보내지 않고 당신의 기기에서 완전히 오프라인으로 작동합니다 — 어떤 약속에도 의존하지 않는 가장 강력한 프라이버시 보장입니다.Enclave를 셀프 호스팅하려면 무엇이 필요한가요? GPU가 필요한가요?
반드시 GPU가 필요하지는 않습니다. 클라우드 모델 API(OpenAI, Anthropic 등)를 사용한다면 Docker를 돌릴 수 있는 평범한 서버나 가정용 머신으로 충분합니다 — 추론은 클라우드에서 이루어지고, 본 기기는 앱과 데이터베이스만 실행합니다. 로컬 모델(Ollama / vLLM)로 오프라인 추론을 하려는 경우에만 그에 맞는 VRAM과 연산 능력이 필요합니다.
한번 써보시겠어요?
브라우저에서 바로 시작하세요. 신용카드 등록도, 설치도 필요 없습니다.