La base del proyecto es un contenedor LXC en Proxmox utilizando una imagen de Ubuntu. Una vez desplegado, le hemos asignado recursos sin demasiada compasión, actualizado todos los paquetes y preparado el terreno para empezar a jugar con la IA local.
Pero antes; ¿Qué es Ollama y para qué sirve?
Ollama permite ejecutar modelos de inteligencia artificial directamente en tu ordenador o servidor, sin depender de plataformas externas ni enviar tus conversaciones a servicios en la nube.
Con él puedes descargar y ejecutar modelos como Llama, Qwen, Gemma o DeepSeek, además de integrarlos en otras aplicaciones mediante una API. Si quieres una interfaz gráfica, puedes combinarlo con Open WebUI y tener tu propio asistente de IA accesible desde el navegador.
Lo mejor es que puedes montarlo en tu propio servidor Linux, controlar qué modelos utilizas y experimentar con inteligencia artificial en tu homelab sin necesidad de contratar servicios de pago.
Pero recuerda: El rendimiento dependerá del hardware y de la memoria disponibles.
Primer paso: instalar Ollama
Una vez completada la instalación, aprovechamos para instalar también el cliente SSH y dejar el entorno listo para trabajar cómodamente desde cualquier terminal.
Y con eso, primer objetivo cumplido: Ollama ya está instalado
Intentando aprovechar la iGPU
Como el equipo dispone de gráfica integrada Intel, la idea era intentar exprimirla para acelerar la ejecución de los modelos, ya que no tenemos una gráfica Nvidia ni una AMD.... así que vamos a intentar aprovecharla.
Lo primero fue detener el servicio de Ollama y lanzarlo manualmente utilizando Vulkan:
Forzando el uso de la gráfica integrada
Para convencer a Ollama de que la iGPU también merece amor, editamos el servicio:
Tras reiniciar el servicio parecía que todo iba a funcionar... pero no. La GPU seguía resistiéndose.
El problema real: permisos
Después de varias pruebas, descubrimos que el verdadero problema no estaba en Vulkan ni en Ollama, sino en los permisos.
El usuario que ejecuta Ollama no pertenecía al grupo con acceso a los dispositivos gráficos, por lo que la aplicación simplemente no podía utilizarlos, así que un pequeño ajuste en los grupos del sistema, reinicio correspondiente y... ahora sí. Ollama podía acceder correctamente a la iGPU.
Primera prueba de fuego
Con todo funcionando, llegó el momento más satisfactorio de cualquier instalación: descargar el primer modelo.
Como estamos trabajando en un equipo modesto y sin una gráfica dedicada potente, la descarga y preparación inicial requiere algo de paciencia. Aproximadamente cinco minutos de espera para el primer arranque.
Nada dramático. Tiempo suficiente para un café y para pensar en la siguiente locura que vamos a intentar automatizar
Conclusiones
La instalación de Ollama sobre Proxmox ha resultado mucho más sencilla de lo esperado. La parte más delicada ha sido conseguir que la gráfica integrada Intel fuese realmente utilizable, pero una vez resuelto el tema de permisos, todo ha quedado funcionando correctamente.
Petete ya está vivo.
Porque, seamos sinceros, la inteligencia artificial está muy bien para generar imágenes espectaculares, escribir poemas o discutir sobre filosofía. Pero su verdadera prueba de fuego será evitar que vuelva a descubrir a las dos de la madrugada que el almacenamiento está al 100% y media infraestructura ha decidido declararse en huelga. Esa será su primera tarea. Y probablemente la más importante. 😅


.png)