Un stack de IA local, no tres alternativas

A diferencia de otras comparativas de esta sección, Proxmox, Podman y Ollama no compiten entre sí — son tres capas de la misma pila si quieres correr modelos de lenguaje en tu propio homelab sin depender de la nube.

Proxmox: la base

El hipervisor sobre el que vive todo lo demás. Si vas a dedicar una máquina (o una VM con GPU passthrough) a IA local, Proxmox es donde se decide cuánta RAM, CPU y VRAM le tocan a esa carga sin que compita con el resto de servicios del homelab.

Podman: el empaquetado

Encima del hipervisor (o directamente en el host), Podman aísla el runtime de inferencia sin el daemon como root de Docker — coherente con cómo está montado el resto de este sitio, dicho sea de paso. Rootless también aquí importa: un contenedor de IA con acceso a la GPU es justo el tipo de proceso que conviene no correr como root.

Ollama: el modelo en marcha

La pieza visible: descarga y sirve modelos de pesos abiertos (Llama, Qwen, Mistral...) con una API compatible con OpenAI, lista para conectar a cualquier cliente. Es la capa que de verdad se usa; las otras dos son la infraestructura para que corra de forma aislada, reproducible y sin comerse el resto del servidor.