Archivo del blog

Mostrando entradas con la etiqueta telegram. Mostrar todas las entradas
Mostrando entradas con la etiqueta telegram. Mostrar todas las entradas

09 octubre 2026

Petete ya está en marcha: instalando Ollama sobre Proxmox con iGPU Intel

La instalación de Petete ha ido sorprendentemente bien. Que ya es decir, ahora  me ha tocado sudar lo que no está escrito para que me funcione con mi Proxmox, y no es por otra cosa que "sus bajos recursos" para lanzar una IA.

La base del proyecto es un contenedor LXC en Proxmox utilizando una imagen de Ubuntu. Una vez desplegado, le hemos asignado recursos sin demasiada compasión, actualizado todos los paquetes y preparado el terreno para empezar a jugar con la IA local.


Pero antes; ¿Qué es Ollama y para qué sirve?

Ollama permite ejecutar modelos de inteligencia artificial directamente en tu ordenador o servidor, sin depender de plataformas externas ni enviar tus conversaciones a servicios en la nube.

Con él puedes descargar y ejecutar modelos como Llama, Qwen, Gemma o DeepSeek, además de integrarlos en otras aplicaciones mediante una API. Si quieres una interfaz gráfica, puedes combinarlo con Open WebUI y tener tu propio asistente de IA accesible desde el navegador.

Lo mejor es que puedes montarlo en tu propio servidor Linux, controlar qué modelos utilizas y experimentar con inteligencia artificial en tu homelab sin necesidad de contratar servicios de pago.

Pero recuerda: El rendimiento dependerá del hardware y de la memoria disponibles.


Primer paso: instalar Ollama


La instalación es tan sencilla como ejecutar un comando por terminal, pero antes necesitamos tener instalado zstd, que es un algoritmo de compresión de datos, como ZIP o GZIP.

Así que primero vamos a instalarlo:

    sudo apt install zstd -y

Y con el zstd --version comprobamos que está


La instalación es tan sencilla como ejecutar:

    curl -fsSL https://ollama.com/install.sh | sh


Una vez completada la instalación, aprovechamos para instalar también el cliente SSH y dejar el entorno listo para trabajar cómodamente desde cualquier terminal.

Y con eso, primer objetivo cumplido: Ollama ya está instalado



Intentando aprovechar la iGPU

Como el equipo dispone de gráfica integrada Intel, la idea era intentar exprimirla para acelerar la ejecución de los modelos, ya que no tenemos una gráfica Nvidia ni una AMD.... así que vamos  a intentar aprovecharla.

Lo primero fue detener el servicio de Ollama y lanzarlo manualmente utilizando Vulkan:


Una vez parado ponemos:

    OLLAMA_VULKAN=1 ollama serve

El resultado fue prometedor: Ollama detectaba la GPU, sabía que existía... pero prácticamente la ignoraba por tratarse de una iGPU. Vamos, que la veía pero no quería salir con ella...


Forzando el uso de la gráfica integrada

Para convencer a Ollama de que la iGPU también merece amor, editamos el servicio:

    nano /etc/systemd/system/ollama.service

Y añadimos las siguientes líneas extras:

Environment="OLLAMA_VULKAN=1" 
Environment="OLLAMA_IGPU_ENABLE=1"


Tras reiniciar el servicio parecía que todo iba a funcionar... pero no. La GPU seguía resistiéndose.


El problema real: permisos


Después de varias pruebas, descubrimos que el verdadero problema no estaba en Vulkan ni en Ollama, sino en los permisos.

El usuario que ejecuta Ollama no pertenecía al grupo con acceso a los dispositivos gráficos, por lo que la aplicación simplemente no podía utilizarlos, así que un pequeño ajuste en los grupos del sistema, reinicio correspondiente y... ahora sí. Ollama podía acceder correctamente a la iGPU.



Y comprobamos que ahora el grupo ollama tiene acceso:


Primera prueba de fuego

Con todo funcionando, llegó el momento más satisfactorio de cualquier instalación: descargar el primer modelo.

Como estamos trabajando en un equipo modesto y sin una gráfica dedicada potente, la descarga y preparación inicial requiere algo de paciencia. Aproximadamente cinco minutos de espera para el primer arranque.

Nada dramático. Tiempo suficiente para un café y para pensar en la siguiente locura que vamos a intentar automatizar



Conclusiones


La instalación de Ollama sobre Proxmox ha resultado mucho más sencilla de lo esperado. La parte más delicada ha sido conseguir que la gráfica integrada Intel fuese realmente utilizable, pero una vez resuelto el tema de permisos, todo ha quedado funcionando correctamente.


Petete ya está vivo.



Porque, seamos sinceros, la inteligencia artificial está muy bien para generar imágenes espectaculares, escribir poemas o discutir sobre filosofía. Pero su verdadera prueba de fuego será evitar que vuelva a descubrir a las dos de la madrugada que el almacenamiento está al 100% y media infraestructura ha decidido declararse en huelga. Esa será su primera tarea. Y probablemente la más importante. 😅






Petete ya está en marcha: instalando Ollama sobre Proxmox con iGPU Intel

La instalación de Petete ha ido sorprendentemente bien. Que ya es decir, ahora  me ha tocado sudar lo que no está escrito para que me funcio...