Ollama + Open-WebUI로 로컬 프라이빗 AI 챗봇 구축 가이드
최근 로컬 환경에서 오픈소스 대형 언어 모델(LLM)을 실행할 수 있는 Ollama와 ChatGPT 스타일의 웹 인터페이스를 제공하는 Open-WebUI를 조합하여 기업 내부나 로컬PC에 프라이빗 AI 챗봇 환경을 구축하는 사례가 늘고 있습니다. 이 가이드에서는 Docker Compose를 활용하여 GPU 가속이 지원되는 프라이빗 AI 챗봇 시스템을 손쉽게 구축하는 방법을 설명합니다. 1. 아키텍처 개요 Ollama: Llama 3.1, Gemma 2, Mistral, Qwen 2.5 등 오픈소스 LLM 모델을 로컬에서 효율적으로 실행하고 REST API를 제공하는 백엔드 엔진. Open-WebUI: Ollama REST API와 연동하여 웹 브라우저에서 대화, 모델 변경, 문서 기반 RAG(Retrieval-Augmented Generation), 사용자 관리 등을 지원하는 웹 프론트엔드. [ 웹 브 라 우 저 ( 사 용 자 ) ] ─ ─ ( H T T P 3 0 0 0 ) ─ ─ > [ O p e n - W e b U I ] ─ ─ ( R E S T 1 1 4 3 4 ) ─ ─ > [ O l l a m a 엔 진 ( N V I D I A G P U ) ] 2. 사전 준비사항 Docker & Docker Compose 설치 완료 NVIDIA GPU 드라이버 및 NVIDIA Container Toolkit 설치 완료 (GPU 사용 시) GPU가 없더라도 CPU 모드로 실행 가능합니다. 3. Docker Compose 구성 docker-compose.yml 파일을 작성하여 Ollama와 Open-WebUI 서비스를 구성합니다. ...