CR-2026-02 · Terminado · downtime 0
Sacar a APOLO de VMware sin apagar nada
- Alcance
- 7 máquinas, VMware ESXi → Proxmox
- Periodo
- ago. 2025 – feb. 2026
- Resultado
- Downtime 0, licencias USD 0. Carga promedio de nodo 55 % → 35 % con workloads equivalentes
- Estado
- Terminado
- Evidencia
- Producción
Resumen
En APOLO migré siete máquinas de VMware ESXi a Proxmox sin downtime, y el costo de licencias de virtualización quedó en USD 0. Con eso APOLO dejó de pagar por el hypervisor, y los investigadores que comparten los clusters no se quedaron sin servicios mientras hacía el cambio. Después ajusté parámetros del kernel y del sistema operativo, y con workloads equivalentes la carga promedio de nodo bajó de 55 % a 35 %.
APOLO es el centro de computación científica donde hice mi práctica, y esta migración fue mi proyecto de práctica. Mi trabajo cubría dos clusters, APOLO 2 y APOLO 3, y los servicios que los rodean, como FreeIPA, que maneja la autenticación de los usuarios en los clusters, y un colector central de Prometheus que le pasa las métricas a un servidor de Grafana para el monitoreo.
La migración en sí fue solo un paso dentro del proyecto. Primero evalué Proxmox como la nueva plataforma y preparé todo. Después convertí las máquinas de ESXi a Proxmox sin que los servicios dejaran de funcionar, y una vez todo quedó en Proxmox ajusté los parámetros del kernel y del sistema operativo y revisé el resultado.
En ese mismo entorno configuré el firewall de Proxmox y UFW para restringir el tráfico no deseado. También dejé los backups de las máquinas virtuales en una ubicación protegida del NAS, que es el camino de vuelta si falla un host o un servicio.
Cómo se midió
El dato sale de producción. Se comparó la carga promedio de nodo en los dos entornos de hypervisor, el de ESXi y el de Proxmox, con workloads equivalentes: 55 % antes y 35 % después. Son 20 puntos porcentuales, más o menos un 36 % menos de carga frente al punto de partida.
Lo que me gusta de esta comparación es que los dos lados corrieron el mismo tipo de trabajo. Cambió la plataforma de abajo y cambiaron los ajustes, y por eso esos 20 puntos los cuento como un solo resultado de las dos cosas juntas.
Notas de la línea de tiempo
Cuando terminó la práctica, en febrero de 2026, me quedé en APOLO como Monitor de Supercomputación con las mismas responsabilidades principales, hasta julio de 2026. O sea que Proxmox, la plataforma que yo había evaluado, a la que había migrado las máquinas y que había ajustado, siguió siendo mi responsabilidad cinco meses más.
Me parece que esa es una prueba justa: la misma persona que evaluó Proxmox, migró las máquinas y ajustó los parámetros fue la que tuvo que sostenerlo los siguientes cinco meses.
Línea de tiempo
ago. 2025Entré a APOLO como Analista de Supercomputación, en práctica. La migración fue mi proyecto.
- Evalué Proxmox como la nueva plataforma y preparé la migración
- Migré las 7 máquinas de VMware ESXi a Proxmox sin downtime
- Ajusté parámetros del kernel y del sistema operativo
- Carga promedio de nodo con workloads equivalentes de producción, en los dos hypervisors: 55 % → 35 %
feb. 2026Terminó la práctica. Seguí en APOLO como Monitor de Supercomputación hasta julio de 2026
Stack
Proxmox · VMware ESXi · Ajustes del kernel Linux · UFW · NAS
Siguiente revisión: ASC26 en Wuxi: lo mío fue la infraestructura Siguiente revisión: Middleware de mensajería en C++, de la replicación a AWS Siguiente revisión: GRID-EAFIT: modelos de predicción energética, en contenedores y en AWS