Ollama ya corre en tu NAS — lo montaste con la guía de primeros pasos. Pero pedirle a tu pareja que abra SSH y escriba ollama run no escala. Open WebUI es la capa que falta: una interfaz web moderna que habla con Ollama por detrás.

Open WebUI no sustituye a Ollama — lo hace visible. Es el equivalente a ponerle ventanas a un motor que ya funciona.

Qué es Open WebUI

Proyecto open source que replica la experiencia de ChatGPT: conversaciones, modelos seleccionables, markdown, subida de archivos para preguntas sobre documentos (RAG ligero), usuarios con login. Se conecta a la API de Ollama en localhost:11434 o a la IP de otro equipo en la red.

  • Gratis y self-hosted — un contenedor Docker.
  • Multi-usuario con cuentas locales.
  • Compatible con todos los modelos que tengas en Ollama.
  • RAG básico arrastrando PDFs — sin montar Anything LLM todavía.

Qué necesitas antes

  • Ollama funcionando — contenedor o instalación nativa con al menos un modelo (llama3.1:8b recomendado).
  • Docker en el NAS o en el mismo PC donde corre Ollama.
  • Consulta requisitos de RAM si el NAS va justo.

Instalar Open WebUI con Docker

docker-compose.yml
services:
  open-webui:
    image: ghcr.io/open-webui/open-webui:main
    container_name: open-webui
    restart: unless-stopped
    ports:
      - "3000:8080"
    volumes:
      - open-webui-data:/app/backend/data
    environment:
      - OLLAMA_BASE_URL=http://host.docker.internal:11434
    extra_hosts:
      - "host.docker.internal:host-gateway"

volumes:
  open-webui-data:
01

Ollama en el mismo host

Si Ollama corre en el NAS fuera de Docker, host.docker.internal:11434 suele funcionar en Docker moderno. Si Ollama también está en Docker, pon la URL del servicio en la misma red compose (ej. http://ollama:11434).

02

Levanta el stack

docker compose up -d. Abre http://IP-NAS:3000. El primer usuario que registres es administrador.

03

Selecciona modelo

En la esquina superior, elige el modelo que hayas descargado con Ollama. Si la lista está vacía, Ollama no es accesible desde el contenedor — revisa la URL.

Primer chat, usuarios y system prompt

Crea cuentas para la familia en Admin → Users. Cada uno ve su historial. Para que el modelo responda siempre en español, en ajustes del chat o en «Model params» añade un system prompt: «Responde siempre en español castellano, de forma clara y concisa.»

En el selector de modelos verás todo lo que tengas en Ollama. Puedes cambiar en mitad de conversación si un modelo pequeño va lento y quieres probar uno más ligero.

RAG básico: preguntar sobre un documento

Open WebUI permite adjuntar PDFs o textos a una conversación. El sistema trocea el documento, busca fragmentos relevantes y se los pasa al modelo — RAG sin configurar nada extra. Funciona bien para un contrato, un manual o un informe suelto.

Para bibliotecas grandes (cientos de PDFs indexados permanentemente), el siguiente nivel es RAG en local con Anything LLM. Open WebUI cubre el 80% del uso casual; Anything LLM el archivo empresarial.

Lo esencial

  • Open WebUI = interfaz ChatGPT para tu Ollama.
  • Un contenedor Docker; conecta a :11434.
  • Primer usuario = admin; crea cuentas familiares.
  • Adjunta PDFs para preguntas puntuales; RAG avanzado → guía RAG.
  • Acceso remoto solo por Tailscale o VPN, nunca puerto abierto.