Skip to content
BotServBotServ
Open WebUIOllamaGestión de modelosIA LocalChat

Gestionar Ollama en Open WebUI

Añade, configura y usa modelos Ollama en Open WebUI. API Keys, selección de modelos y prompts del sistema.

S

schutzgeist

4 min read
Gestionar Ollama en Open WebUI

Gestionar Ollama en Open WebUI

Qué cubre este artículo sobre Ollama en Open WebUI

  • Cómo conectar Open WebUI con Ollama.
  • Cómo cargar, desactivar y priorizar modelos.
  • Cómo usar prompts del sistema, parámetros y selección de modelos.
  • Cómo integrar múltiples instancias de Ollama.
  • Problemas comunes y buenas prácticas.

Introducción: Gestionar Ollama en Open WebUI

Open WebUI es una interfaz amigable para chatear con modelos de lenguaje locales. Ollama proporciona los modelos y la API. Al conectar ambos, obtienes una interfaz web sencilla para acceder a todos tus modelos locales sin necesidad de trabajar en la línea de comandos.

Gestionar Ollama en Open WebUI es directo una vez que la conexión está establecida. En este artículo te mostramos cómo añadir modelos, ajustar configuraciones y resolver problemas típicos.

Requisitos previos

  • Ollama está instalado y en ejecución.
  • Open WebUI está instalado, por ejemplo con Docker.
  • Ambos servicios pueden comunicarse entre sí.

Configurar la conexión

Open WebUI detecta Ollama automáticamente si se ejecuta en el mismo host. De manera predeterminada, espera Ollama en:

http://host.docker.internal:11434

Si Ollama se ejecuta fuera de Docker, establece la variable de entorno en Open WebUI:

-e OLLAMA_BASE_URL=http://host.docker.internal:11434

Para una instancia Ollama separada, especifica la IP o el nombre del host:

-e OLLAMA_BASE_URL=http://192.168.1.50:11434

Descargar modelos

En Open WebUI puedes cargar modelos directamente desde la interfaz:

  1. Abre Configuración.
  2. Ve a Models o Admin Settings.
  3. Selecciona Pull a model from Ollama.com.
  4. Ingresa el nombre del modelo, por ejemplo llama3.1:8b.
  5. Inicia la descarga.

Alternativamente, desde la terminal:

ollama pull llama3.1:8b
ollama pull mistral
ollama pull qwen2.5:14b

Una vez que el modelo esté disponible localmente, aparecerá en Open WebUI.

Seleccionar modelos en el chat

En la ventana de chat, puedes elegir el modelo deseado en la parte superior. Open WebUI muestra todos los modelos Ollama disponibles localmente. También puedes cambiar el modelo durante una conversación, pero ten en cuenta que el contexto anterior no se transfiere automáticamente.

Prompts del sistema y parámetros

Para cada modelo, puedes ajustar configuraciones en Open WebUI:

  • System Prompt: Instrucciones de comportamiento para el modelo.
  • Temperature: Equilibrio entre creatividad y determinismo.
  • Top P: Diversidad del muestreo.
  • Max Tokens: Longitud máxima de la respuesta.
  • Context Length: Longitud del contexto utilizado.

Estas configuraciones pueden establecerse globalmente, por modelo o por conversación.

Múltiples instancias de Ollama

Si tienes varios servidores Ollama, Open WebUI puede trabajar con múltiples backends mediante configuraciones correspondientes o un proxy inverso. Sin embargo, para la mayoría de casos, una instancia central de Ollama es suficiente.

Priorizar modelos y controlar visibilidad

Los administradores pueden controlar en Open WebUI qué modelos son visibles para los usuarios. Esto es útil cuando:

  • Solo ciertos modelos deben estar permitidos.
  • Los modelos grandes deben estar disponibles solo para administradores.
  • Los modelos de prueba deben ocultarse antes de su lanzamiento.

Claves API y proveedores externos

Open WebUI puede usar proveedores externos como OpenAI, Anthropic u OpenRouter, además de Ollama. Para ello, ingresa las claves API en la configuración. Localmente, Ollama sigue siendo el estándar sin costos por solicitud.

Actualizar y eliminar modelos

Puedes actualizar versiones más recientes mediante Ollama:

ollama pull llama3.1:8b

Para eliminar un modelo, usa:

ollama rm llama3.1:8b

En Open WebUI, los modelos eliminados desaparecerán después de actualizar la página.

Problemas comunes

  • No hay conexión a Ollama: Verifica OLLAMA_BASE_URL y la accesibilidad.
  • El modelo no aparece: Ollama debe haber cargado el modelo, actualiza Open WebUI.
  • Memoria insuficiente: El modelo no se carga, Ollama se detiene.
  • Tamaño de modelo incorrecto: llama3.1 sin etiqueta carga latest de forma predeterminada, a menudo 70B.
  • Problemas de red: Verifica la resolución de nombres del contenedor.

Enlaces informativos adicionales

Preguntas frecuentes: Ollama en Open WebUI

¿Cómo conectar Open WebUI con Ollama? Generalmente de forma automática si ambos se ejecutan en el mismo host. De lo contrario, establece OLLAMA_BASE_URL.

¿Puedo descargar modelos directamente en Open WebUI? Sí, desde el área de administrador o usando ollama pull en la terminal.

¿Cuántos modelos puedo usar simultáneamente? Los que quepan en la memoria RAM. Cada conversación carga el modelo seleccionado.

¿Necesito claves API? Solo si deseas usar proveedores externos además de Ollama.

¿Qué sucede si no tengo suficiente RAM? El modelo no se cargará o funcionará muy lentamente. En ese caso, elige modelos más pequeños o usa cuantización.

Referencias y lectura complementaria

Resumen: Gestionar Ollama en Open WebUI

Open WebUI es una interfaz cómoda para trabajar con modelos Ollama. Después de conectar mediante OLLAMA_BASE_URL, puedes descargar modelos, seleccionarlos y operarlos con prompts y parámetros personalizados. Los administradores controlan la visibilidad y los proveedores. Quien mantenga un seguimiento de la conexión, la memoria y los tamaños de los modelos obtiene un acceso simple a inteligencia artificial local.

Volver al blog
Share:

Entradas relacionadas