Gestionar Ollama en Open WebUI
Qué cubre este artículo sobre Ollama en Open WebUI
- Cómo conectar Open WebUI con Ollama.
- Cómo cargar, desactivar y priorizar modelos.
- Cómo usar prompts del sistema, parámetros y selección de modelos.
- Cómo integrar múltiples instancias de Ollama.
- Problemas comunes y buenas prácticas.
Introducción: Gestionar Ollama en Open WebUI
Open WebUI es una interfaz amigable para chatear con modelos de lenguaje locales. Ollama proporciona los modelos y la API. Al conectar ambos, obtienes una interfaz web sencilla para acceder a todos tus modelos locales sin necesidad de trabajar en la línea de comandos.
Gestionar Ollama en Open WebUI es directo una vez que la conexión está establecida. En este artículo te mostramos cómo añadir modelos, ajustar configuraciones y resolver problemas típicos.
Requisitos previos
- Ollama está instalado y en ejecución.
- Open WebUI está instalado, por ejemplo con Docker.
- Ambos servicios pueden comunicarse entre sí.
Configurar la conexión
Open WebUI detecta Ollama automáticamente si se ejecuta en el mismo host. De manera predeterminada, espera Ollama en:
http://host.docker.internal:11434
Si Ollama se ejecuta fuera de Docker, establece la variable de entorno en Open WebUI:
-e OLLAMA_BASE_URL=http://host.docker.internal:11434
Para una instancia Ollama separada, especifica la IP o el nombre del host:
-e OLLAMA_BASE_URL=http://192.168.1.50:11434
Descargar modelos
En Open WebUI puedes cargar modelos directamente desde la interfaz:
- Abre Configuración.
- Ve a
ModelsoAdmin Settings. - Selecciona
Pull a model from Ollama.com. - Ingresa el nombre del modelo, por ejemplo
llama3.1:8b. - Inicia la descarga.
Alternativamente, desde la terminal:
ollama pull llama3.1:8b
ollama pull mistral
ollama pull qwen2.5:14b
Una vez que el modelo esté disponible localmente, aparecerá en Open WebUI.
Seleccionar modelos en el chat
En la ventana de chat, puedes elegir el modelo deseado en la parte superior. Open WebUI muestra todos los modelos Ollama disponibles localmente. También puedes cambiar el modelo durante una conversación, pero ten en cuenta que el contexto anterior no se transfiere automáticamente.
Prompts del sistema y parámetros
Para cada modelo, puedes ajustar configuraciones en Open WebUI:
- System Prompt: Instrucciones de comportamiento para el modelo.
- Temperature: Equilibrio entre creatividad y determinismo.
- Top P: Diversidad del muestreo.
- Max Tokens: Longitud máxima de la respuesta.
- Context Length: Longitud del contexto utilizado.
Estas configuraciones pueden establecerse globalmente, por modelo o por conversación.
Múltiples instancias de Ollama
Si tienes varios servidores Ollama, Open WebUI puede trabajar con múltiples backends mediante configuraciones correspondientes o un proxy inverso. Sin embargo, para la mayoría de casos, una instancia central de Ollama es suficiente.
Priorizar modelos y controlar visibilidad
Los administradores pueden controlar en Open WebUI qué modelos son visibles para los usuarios. Esto es útil cuando:
- Solo ciertos modelos deben estar permitidos.
- Los modelos grandes deben estar disponibles solo para administradores.
- Los modelos de prueba deben ocultarse antes de su lanzamiento.
Claves API y proveedores externos
Open WebUI puede usar proveedores externos como OpenAI, Anthropic u OpenRouter, además de Ollama. Para ello, ingresa las claves API en la configuración. Localmente, Ollama sigue siendo el estándar sin costos por solicitud.
Actualizar y eliminar modelos
Puedes actualizar versiones más recientes mediante Ollama:
ollama pull llama3.1:8b
Para eliminar un modelo, usa:
ollama rm llama3.1:8b
En Open WebUI, los modelos eliminados desaparecerán después de actualizar la página.
Problemas comunes
- No hay conexión a Ollama: Verifica
OLLAMA_BASE_URLy la accesibilidad. - El modelo no aparece: Ollama debe haber cargado el modelo, actualiza Open WebUI.
- Memoria insuficiente: El modelo no se carga, Ollama se detiene.
- Tamaño de modelo incorrecto:
llama3.1sin etiqueta cargalatestde forma predeterminada, a menudo 70B. - Problemas de red: Verifica la resolución de nombres del contenedor.
Enlaces informativos adicionales
- BotServ.de Funciones de Open WebUI
- BotServ.de Configurar RAG en Open WebUI
- BotServ.de Herramientas de Open WebUI
- BotServ.de Múltiples usuarios en Open WebUI
Preguntas frecuentes: Ollama en Open WebUI
¿Cómo conectar Open WebUI con Ollama?
Generalmente de forma automática si ambos se ejecutan en el mismo host. De lo contrario, establece OLLAMA_BASE_URL.
¿Puedo descargar modelos directamente en Open WebUI?
Sí, desde el área de administrador o usando ollama pull en la terminal.
¿Cuántos modelos puedo usar simultáneamente? Los que quepan en la memoria RAM. Cada conversación carga el modelo seleccionado.
¿Necesito claves API? Solo si deseas usar proveedores externos además de Ollama.
¿Qué sucede si no tengo suficiente RAM? El modelo no se cargará o funcionará muy lentamente. En ese caso, elige modelos más pequeños o usa cuantización.
Referencias y lectura complementaria
- Documentación de Open WebUI: https://docs.openwebui.com/
- Documentación de Ollama: https://github.com/ollama/ollama/blob/main/docs/
- GitHub de Open WebUI: https://github.com/open-webui/open-webui
Resumen: Gestionar Ollama en Open WebUI
Open WebUI es una interfaz cómoda para trabajar con modelos Ollama. Después de conectar mediante OLLAMA_BASE_URL, puedes descargar modelos, seleccionarlos y operarlos con prompts y parámetros personalizados. Los administradores controlan la visibilidad y los proveedores. Quien mantenga un seguimiento de la conexión, la memoria y los tamaños de los modelos obtiene un acceso simple a inteligencia artificial local.


