Skip to content
BotServBotServ
OllamaWindowsInstalaciónGPUWSL2IA local

Ollama en Windows: Instalación y configuración

Instala y configura Ollama en Windows. Guía paso a paso con GPU, WSL2 y solución de problemas.

S

schutzgeist

11 min read
Ollama en Windows: Instalación y configuración

Ollama en Windows: instalación y configuración

Qué cubre este artículo sobre Ollama en Windows

  • Cómo instalar Ollama en Windows 10 y Windows 11.
  • Cómo verificar si tu GPU es reconocida y está configurada correctamente.
  • Cómo iniciar tu primer modelo y usar la API desde PowerShell.
  • Cómo configurar Ollama en WSL2 y acceder a la GPU de Windows.
  • Cuáles son los problemas típicos y cómo resolverlos.

Introducción: Ollama en Windows explicado de forma clara

Ollama es un entorno de ejecución para modelos de lenguaje abiertos. Descarga modelos, los gestiona y proporciona una API local. En Windows, hay un instalador oficial que configura Ollama como servicio de fondo. No necesitas Linux ni un entorno de desarrollo complicado para comenzar. Este artículo te guía paso a paso a través de la instalación, la configuración de la GPU y los primeros modelos. Para obtener más contexto sobre Ollama, consulta la descripción general de Ollama.

¿Por qué necesito esta guía?

Imagina que descargas Ollama, lo instalas e intentas ejecutar tu primer modelo. En lugar de una respuesta fluida, todo va entrecortado porque la GPU no es reconocida. O lees en algún lugar que necesitas WSL2, pero no sabes si es relevante para tu caso de uso. Quizás también hayas intentado llamar a la API desde PowerShell y recibido mensajes de error porque la sintaxis no es correcta.

Este artículo aborda exactamente estas situaciones. Obtienes instrucciones claras para instalar Ollama en Windows, configurar tu GPU e iniciar los primeros modelos. Si nunca has trabajado con IA local, primero lee ¿Qué es la IA local?.

Ollama en Windows explicado brevemente

Ollama está disponible para Windows como instalador listo para usar. Descargas el archivo del sitio web oficial, lo ejecutas y Ollama se configura como servicio de fondo. Luego abres PowerShell o el símbolo del sistema y usas comandos como ollama run llama3.1 para iniciar modelos. Si tienes una GPU Nvidia, Ollama la reconoce automáticamente siempre que los controladores estén actualizados. También hay soporte para AMD e Intel, aunque en algunos casos requiere más trabajo. Accedes a la API en http://localhost:11434.

A quién va dirigida esta guía

Esta guía es para usuarios de Windows que instalan Ollama por primera vez. No necesitas conocimientos de programación, pero debes saber cómo abrir PowerShell o el símbolo del sistema. Si ya tienes experiencia con Ollama y solo deseas resolver problemas específicos, salta directamente a la sección sobre dificultades comunes o a Solución de problemas.

Términos importantes relacionados con Ollama en Windows

TérminoSignificado
OllamaEntorno de ejecución para modelos de lenguaje local
WSL2Windows Subsystem for Linux, permite ejecutar programas Linux en Windows
GPUTarjeta gráfica que acelera los cálculos
CUDAPlataforma Nvidia para cálculos en GPU
ControladorSoftware que conecta el sistema operativo con la GPU
PowerShellLínea de comandos moderna en Windows
CMDSímbolo del sistema clásico en Windows
Docker DesktopInterfaz gráfica para Docker en Windows
PATHVariable de entorno que especifica dónde busca el sistema los programas
ServiceProceso de fondo que se ejecuta automáticamente

Requisitos previos

Antes de instalar Ollama, verifica estos puntos:

  • Sistema operativo: Windows 10 (a partir de la versión 2004, compilación 19041) o Windows 11. Ambas versiones reciben soporte oficial.
  • Controladores de GPU: Un controlador gráfico actualizado es importante. Para Nvidia, el controlador debe ser la versión 525 o más reciente. Para AMD, necesitas Adrenalin 23.11.1 o superior. Las GPU Intel a partir de la serie Arc también son soportadas.
  • RAM: Mínimo 8 GB para modelos pequeños. Para modelos de 7B como Llama 3.1 se recomiendan 16 GB. Los modelos más grandes requieren más memoria en consecuencia.
  • Espacio de almacenamiento: Cada modelo ocupa varios gigabytes. Planifica al menos 20 GB de espacio libre si deseas probar múltiples modelos.
  • PowerShell o CMD: Debes saber cómo abrir una línea de comandos. Presiona Windows + R, escribe powershell y pulsa Enter.

Para más información sobre los fundamentos, consulta el artículo Ejecutar LLM localmente.

Paso 1: Descargar e instalar Ollama

Descarga el instalador del sitio web oficial:

  1. Abre https://ollama.com/download en tu navegador.
  2. Selecciona la descarga para Windows. Recibirás un archivo llamado OllamaSetup.exe.
  3. Ejecuta el archivo haciendo doble clic. Windows puede mostrar una advertencia de seguridad. Confirma que deseas ejecutar la aplicación.
  4. El instalador se ejecuta automáticamente. No necesitas ajustar ninguna ruta.
  5. Después de completar la instalación, Ollama se ejecuta como servicio de fondo. Verás un pequeño icono en la bandeja del sistema, en la esquina inferior derecha de la barra de tareas.

Abre PowerShell y verifica que Ollama esté disponible:

ollama --version

Si ves un número de versión, la instalación fue exitosa. Si el comando no se encuentra, reinicia PowerShell o verifica que Ollama esté incluido en el PATH. Para más detalles sobre la instalación general, consulta también Instalación de Ollama.

Paso 2: Verificar los controladores de GPU

Ollama utiliza la GPU automáticamente si los controladores están instalados correctamente. Así se verifica.

Nvidia

Abre PowerShell e ingresa el siguiente comando:

nvidia-smi

Verás una tabla con tu GPU, la versión del controlador y la versión de CUDA. Si el comando funciona, tu GPU está lista para Ollama. Si recibas un mensaje de error, instala el controlador más reciente desde el sitio web de Nvidia o a través de GeForce Experience.

AMD

Para GPU AMD necesitas el controlador Adrenalin más reciente. Ollama utiliza la interfaz ROCm, que se soporta a partir de la versión de controlador 23.11.1. Verifica en PowerShell:

wmic path win32_VideoController get name

Si la salida confirma tu GPU AMD, Ollama debería reconocerla después de la instalación. Si no, actualiza el controlador a través de la herramienta AMD Software.

Intel

Las GPU Intel a partir de la serie Arc son soportadas. Asegúrate de que el controlador Intel Arc esté actualizado. Las GPU integradas más antiguas como Intel UHD se reconocen parcialmente, pero ofrecen poco rendimiento. Para más información sobre este tema, consulta CPU vs. GPU.

Paso 3: Iniciar tu primer modelo

Después de la instalación y la verificación de la GPU, descargas tu primer modelo. Abre PowerShell e ingresa:

ollama run llama3.1

El comando descarga el modelo automáticamente si aún no está disponible localmente. La descarga tarda algunos minutos según tu velocidad de conexión. Luego inicia el chat directamente en la terminal. Puedes hacer una pregunta de inmediato:

>>> Explica la IA local en tres oraciones.

El modelo responde directamente en la terminal. Cierra la sesión con /bye o presiona Ctrl + D. Encuentra más modelos en Gestión de modelos de Ollama.

Paso 4: Usar la API

Ollama expone una API HTTP en http://localhost:11434. Puedes llamarla desde PowerShell, Python u otros lenguajes de programación.

Llamada a la API desde PowerShell

$body = @{
    model = "llama3.1"
    prompt = "Was ist lokale KI?"
    stream = $false
} | ConvertTo-Json

Invoke-RestMethod -Uri "http://localhost:11434/api/generate" -Method Post -Body $body -ContentType "application/json"

La respuesta llega como un objeto JSON. El campo response contiene el texto generado.

Llamada a la API con Python

import requests

response = requests.post(
    "http://localhost:11434/api/generate",
    json={
        "model": "llama3.1",
        "prompt": "Erkläre Quantisierung in zwei Saetzen.",
        "stream": False
    }
)
print(response.json()["response"])

Encontrarás más ejemplos y endpoints en el artículo Ollama API.

Ollama con WSL2

WSL2 te permite ejecutar programas Linux en Windows. Esto es útil si quieres usar Ollama en un entorno Linux, por ejemplo porque tienes herramientas o scripts basados en Linux. Hay dos escenarios posibles:

Escenario 1: Ollama se ejecuta en Windows y lo usas desde WSL2

Si instalaste Ollama en Windows, el servicio se ejecuta en segundo plano. Desde WSL2 accedes a la API a través de la IP de Windows. Abre WSL2 y usa la API:

curl http://host.docker.internal:11434/api/generate -d '{
  "model": "llama3.1",
  "prompt": "Hallo aus WSL2",
  "stream": false
}'

La dirección host.docker.internal apunta al host Windows. De esta manera puedes dejar Ollama funcionando en Windows y aún así acceder a él desde WSL2.

Escenario 2: Instalar Ollama directamente en WSL2

Alternativamente, instala Ollama directamente en WSL2 con el script de Linux:

curl -fsSL https://ollama.com/install.sh | sh

En este caso, Ollama utiliza la GPU a través de la función WSL2 GPU Passthrough. Para ello, WSL2 debe estar configurado con soporte de GPU. Funciona mejor con GPUs Nvidia. Instala el CUDA Toolkit en WSL2 si Ollama no detecta la GPU automáticamente.

Ten cuidado de no ejecutar ambas variantes simultáneamente. Si Ollama se ejecuta en Windows y en WSL2, pueden ocurrir conflictos de puerto ya que ambos usan el puerto 11434.

Ollama como servicio de Windows

Después de instalar con el instalador oficial, Ollama se ejecuta automáticamente como servicio de fondo. Esto significa que no necesitas iniciar Ollama manualmente. El servicio se ejecuta en segundo plano después de reiniciar Windows y proporciona la API.

Puedes verificar el estado en PowerShell:

Get-Service ollama

Si el estado es Running, el servicio está activo. Inícialo manualmente con:

Start-Service ollama

Puedes detenerlo con:

Stop-Service ollama

El servicio se inicia automáticamente al arrancar el sistema. Si quieres cambiar esto, puedes ajustar el tipo de inicio:

Set-Service ollama -StartupType Manual

Configuración: Cambiar la ubicación de almacenamiento

Por defecto, Ollama almacena los modelos en el directorio de usuario bajo C:\Users\DeinName\.ollama\models. Si tu disco del sistema tiene poco espacio, puedes cambiar la ubicación mediante una variable de entorno.

Establece la variable OLLAMA_MODELS en una ruta diferente:

[System.Environment]::SetEnvironmentVariable("OLLAMA_MODELS", "D:\ollama-models", "User")

Después debes reiniciar el servicio Ollama para que el cambio surta efecto:

Restart-Service ollama

Los modelos descargados recientemente se almacenarán en el nuevo directorio. Los modelos ya descargados deben trasladarse manualmente o descargarse nuevamente. Encontrarás más opciones de configuración en Ollama Configuración.

Problemas comunes con Ollama en Windows

1. GPU no reconocida

Ollama vuelve a la CPU si los drivers de GPU están desactualizados o faltan. Comprueba con nvidia-smi si la GPU está disponible. Actualiza el driver y reinicia el servicio Ollama.

2. Comando ollama no encontrado

Después de la instalación, a veces el comando no está disponible inmediatamente. Cierra PowerShell y vuelve a abrirlo. Si eso no funciona, verifica que Ollama esté en el PATH. La ruta predeterminada es C:\Users\DeinName\AppData\Local\Programs\Ollama.

3. Puerto 11434 ocupado

Si otro programa usa el puerto, Ollama no inicia correctamente. Verifica con netstat -ano | findstr 11434 qué proceso bloquea el puerto. Termina el proceso o cambia el puerto usando la variable de entorno OLLAMA_HOST.

4. Los modelos se cargan lentamente

Si Ollama se ejecuta sin GPU, la carga de modelos grandes tarda mucho tiempo. Verifica la detección de GPU y asegúrate de tener suficiente VRAM. Un modelo de 7B necesita aproximadamente 4 a 5 GB de VRAM.

5. WSL2 y Windows Ollama simultáneamente

Si instalaste Ollama en Windows y en WSL2, hay conflictos de puerto. Elige una variante. Usa la instalación de Windows y accede a la API desde WSL2, o instala Ollama solo en WSL2.

6. El antivirus bloquea Ollama

Algunos programas antivirus bloquean la descarga de modelos o el servicio mismo. Añade Ollama a la lista de excepciones de tu programa antivirus si tienes problemas.

7. Caracteres especiales en PowerShell

PowerShell a veces tiene problemas con caracteres especiales en prompts. Usa en su lugar ae, oe y ue, o utiliza la API con Python, donde la codificación funciona de manera más limpia.

Encontrarás más soluciones en el artículo Ollama Solución de problemas.

Hardware, costos y seguridad en Ollama en Windows

Hardware

El rendimiento depende en gran medida de tu hardware. Una GPU Nvidia con 8 GB de VRAM es suficiente para modelos de 7B como Llama 3.1. Para modelos de 13B necesitas al menos 12 GB de VRAM. Sin GPU, Ollama se ejecuta en la CPU, lo que es significativamente más lento. Más información en CPU vs. GPU.

Costos

Ollama es Open Source y gratuito. Los costos solo surgen por el hardware y la electricidad. Descargar un modelo de 4 GB no cuesta nada más que tu ancho de banda de internet.

Seguridad

Ollama se ejecuta localmente por defecto. La API es accesible en localhost, no desde el exterior. Si quieres compartir la API en la red, establece OLLAMA_HOST=0.0.0.0:11434. En ese caso, presta atención a las reglas del firewall y a la autenticación. Todos los modelos y datos permanecen en tu ordenador. Nada se envía a servicios en la nube.

Enlaces y referencias adicionales sobre Ollama en Windows

Preguntas frecuentes: Ollama en Windows

¿Necesito WSL2 para usar Ollama en Windows?

No. El instalador oficial de Windows es suficiente. WSL2 solo es necesario si quieres usar específicamente un entorno Linux.

¿Funciona Ollama sin GPU?

Sí, Ollama se ejecuta en la CPU. El rendimiento es mucho menor, pero suficiente para modelos pequeños y pruebas.

¿Dónde almacena Ollama los modelos en Windows?

Por defecto en C:\Users\TuNombre\.ollama\models. Puedes cambiar la ruta mediante la variable de entorno OLLAMA_MODELS.

¿Cómo verifico si mi GPU es detectada?

Para GPUs Nvidia, ejecuta el comando nvidia-smi en PowerShell. Si aparece una tabla con información de la GPU, está lista para usar.

¿Puedo usar Ollama en varias cuentas de usuario de Windows?

Sí, el servicio se ejecuta a nivel del sistema. Sin embargo, los modelos se encuentran en el directorio del usuario. Cada usuario tiene su propia carpeta de modelos, a menos que configures OLLAMA_MODELS con una ruta compartida.

¿Se inicia Ollama automáticamente al arrancar Windows?

Sí, el instalador configura Ollama como un servicio con inicio automático. Puedes cambiar esto en los Servicios de Windows.

¿Puedo usar Ollama y Docker Desktop simultáneamente?

Sí, siempre que no haya conflictos de puertos. Si quieres ejecutar Ollama en Docker, usa un puerto diferente o detén el servicio de Windows. Más información en Ollama con Docker.

¿Cómo cambio el puerto de Ollama?

Configura la variable de entorno OLLAMA_HOST a algo como 127.0.0.1:11435 y reinicia el servicio.

¿Se soportan las GPUs de AMD?

Sí, desde la versión de controlador 23.11.1 con soporte ROCm. Actualiza el controlador Adrenalin y verifica que Ollama reconozca la GPU.

¿Es Ollama gratuito en Windows?

Sí, Ollama es Open Source y gratuito. Los únicos costos son los de hardware y electricidad.

¿Puedo usar Ollama desde PowerShell?

Sí, todos los comandos como ollama run, ollama pull y ollama list funcionan en PowerShell y en el símbolo del sistema tradicional.

Referencias y lecturas complementarias

Volver al blog
Share:

Entradas relacionadas