Open WebUI: la interfaz que convierte Ollama en tu ChatGPT privado
Ollama en terminal impresiona a quien lo instala. Open WebUI lo convierte en algo que el resto de la familia puede usar: chat en el navegador, historial, subida de documentos y cero datos en servidores externos.
Ollama ya corre en tu NAS — lo montaste con la guía de primeros pasos. Pero pedirle a tu pareja que abra SSH y escriba ollama run no escala. Open WebUI es la capa que falta: una interfaz web moderna que habla con Ollama por detrás.
Open WebUI no sustituye a Ollama — lo hace visible. Es el equivalente a ponerle ventanas a un motor que ya funciona.
Qué es Open WebUI
Proyecto open source que replica la experiencia de ChatGPT: conversaciones, modelos seleccionables, markdown, subida de archivos para preguntas sobre documentos (RAG ligero), usuarios con login. Se conecta a la API de Ollama en localhost:11434 o a la IP de otro equipo en la red.
- Gratis y self-hosted — un contenedor Docker.
- Multi-usuario con cuentas locales.
- Compatible con todos los modelos que tengas en Ollama.
- RAG básico arrastrando PDFs — sin montar Anything LLM todavía.
Qué necesitas antes
- Ollama funcionando — contenedor o instalación nativa con al menos un modelo (
llama3.1:8brecomendado). - Docker en el NAS o en el mismo PC donde corre Ollama.
- Consulta requisitos de RAM si el NAS va justo.
Instalar Open WebUI con Docker
services:
open-webui:
image: ghcr.io/open-webui/open-webui:main
container_name: open-webui
restart: unless-stopped
ports:
- "3000:8080"
volumes:
- open-webui-data:/app/backend/data
environment:
- OLLAMA_BASE_URL=http://host.docker.internal:11434
extra_hosts:
- "host.docker.internal:host-gateway"
volumes:
open-webui-data:
Ollama en el mismo host
Si Ollama corre en el NAS fuera de Docker, host.docker.internal:11434 suele funcionar en Docker moderno. Si Ollama también está en Docker, pon la URL del servicio en la misma red compose (ej. http://ollama:11434).
Levanta el stack
docker compose up -d. Abre http://IP-NAS:3000. El primer usuario que registres es administrador.
Selecciona modelo
En la esquina superior, elige el modelo que hayas descargado con Ollama. Si la lista está vacía, Ollama no es accesible desde el contenedor — revisa la URL.
Primer chat, usuarios y system prompt
Crea cuentas para la familia en Admin → Users. Cada uno ve su historial. Para que el modelo responda siempre en español, en ajustes del chat o en «Model params» añade un system prompt: «Responde siempre en español castellano, de forma clara y concisa.»
En el selector de modelos verás todo lo que tengas en Ollama. Puedes cambiar en mitad de conversación si un modelo pequeño va lento y quieres probar uno más ligero.
RAG básico: preguntar sobre un documento
Open WebUI permite adjuntar PDFs o textos a una conversación. El sistema trocea el documento, busca fragmentos relevantes y se los pasa al modelo — RAG sin configurar nada extra. Funciona bien para un contrato, un manual o un informe suelto.
Para bibliotecas grandes (cientos de PDFs indexados permanentemente), el siguiente nivel es RAG en local con Anything LLM. Open WebUI cubre el 80% del uso casual; Anything LLM el archivo empresarial.
Lo esencial
- Open WebUI = interfaz ChatGPT para tu Ollama.
- Un contenedor Docker; conecta a
:11434. - Primer usuario = admin; crea cuentas familiares.
- Adjunta PDFs para preguntas puntuales; RAG avanzado → guía RAG.
- Acceso remoto solo por Tailscale o VPN, nunca puerto abierto.