GKE Autopilot o Standard: la decisión, con los costes que nadie cita
Autopilot cobra por lo que piden tus pods y elimina la gestión de nodos. Es mejor trato de lo que parece para la mayoría de equipos y peor para unos pocos. Así sabes en cuál estás.
El argumento de Autopilot es simple: dejas de gestionar nodos, pagas por las requests de los pods en lugar de por la capacidad de los nodos y Google se ocupa de las actualizaciones, el escalado y la seguridad de los nodos. La objeción es igual de simple: el precio por pod es mayor que el precio por nodo para la misma CPU.
Las dos cosas son ciertas, y cuál gana depende enteramente de un número que casi ningún equipo ha medido: su utilización de nodos.
La aritmética que lo decide de verdad
En Standard pagas los nodos los usen o no los pods. En Autopilot pagas la suma de las requests de los pods, con un sobreprecio por vCPU y GB.
Así que la pregunta es: ¿qué fracción de la capacidad de nodo aprovisionada piden realmente los pods? Llámalo razón de empaquetado.
- Si tus clústeres corren a un 40 o 50 por ciento de empaquetado —lo más común, y el tema de por qué tu clúster de EKS cuesta el doble— Autopilot suele salir más barato pese al sobreprecio, porque dejas de pagar la mitad vacía.
- Si llevas un clúster Standard bien afinado al 70 por ciento o más, con nodos Spot y empaquetado cuidado, Standard gana en precio.
Mide antes de discutir. Suma kube_pod_container_resource_requests en el clúster y divide por el total asignable. Ese único número zanja casi todo el debate.
Donde Autopilot ahorra más que dinero
- Las actualizaciones y el parcheado de nodos dejan de ser una tarea programada. En un clúster Standard esto es trabajo recurrente real, y es el trabajo que se pospone hasta que un CVE obliga.
- La superficie de nodo desaparece. Sin SSH, sin DaemonSets privilegiados, sin configuración de nodo que auditar. Para equipos que van hacia una línea base de cumplimiento, esto quita una categoría entera de controles.
- Los valores por defecto sensatos están impuestos. Workload Identity está activo, los nodos son shielded y no puedes ejecutar por accidente un clúster con IP públicas de nodo.
- Los equipos pequeños dejan de necesitar un especialista en Kubernetes para mantener la plataforma sana, que suele ser la línea de presupuesto real.
Donde Autopilot te va a molestar
- Cargas privilegiadas. Casi todos los agentes de seguridad, algunos plugins de CNI y cualquier cosa que necesite acceso al host o no corren o necesitan una integración soportada. Mira tu lista de DaemonSets primero — es el bloqueo más común.
- GPU y hardware especializado están soportados pero con menos flexibilidad que en Standard, y el modelo de aprovisionamiento es distinto.
- Escalado muy a picos. Autopilot aprovisiona capacidad por pod, lo que añade latencia de planificación frente a un pool Standard ya caliente. Para cargas que necesitan añadir cien pods en diez segundos, mantén un despliegue globo de pods de baja prioridad que reserven capacidad caliente — o quédate en Standard.
- Los DaemonSets se cobran por nodo en un modelo donde tú no controlas el número de nodos, lo que puede sorprender con los agentes de logs.
- Los límites de recursos se imponen en serio. Los pods que en Standard sobrepasaban sus requests en silencio sufrirán throttling. Es discutiblemente correcto, pero parecerá una regresión la primera semana.
Elijas lo que elijas
Cuatro cosas importan más que la propia decisión de Autopilot:
Requests fijadas a partir del uso observado. En Autopilot esto es literalmente tu factura. En Standard es tu razón de empaquetado. En ambos casos, el Vertical Pod Autoscaler en modo recomendación durante dos semanas te da las cifras.
Workload Identity, no claves de cuenta de servicio. Obligatorio en Autopilot, opcional y frecuentemente omitido en Standard. Mira el artículo sobre claves de cuenta de servicio para ver por qué importa más que ninguna otra cosa en seguridad.
Clústeres regionales, no zonales para producción. Un plano de control zonal significa que una caída de zona es una caída del clúster.
Pods Spot donde la carga lo tolere. Disponible en ambos, y es el mayor descuento restante una vez arreglado el empaquetado.
La recomendación
Para un equipo de menos de unos quince ingenieros sin persona dedicada a plataforma, Autopilot es el valor por defecto correcto: el ahorro operativo domina y el sobreprecio suele compensarse con mejor empaquetado. Para un entorno grande con equipo de plataforma, empaquetado afinado y uso intensivo de Spot, Standard mantiene la ventaja, y el trabajo está en el ajuste más que en la elección.
También puedes tener los dos: Autopilot para herramientas internas y preproducción, Standard para la carga de producción de alto volumen. Lo hacemos bastante en proyectos cloud, porque pone el esfuerzo operativo donde produce algo.
Qué hacer esta semana
Calcula tu razón de empaquetado en el clúster más grande. Por debajo del 50 por ciento, cotiza el equivalente en Autopilot — la calculadora de precios de Google acepta directamente las requests de tus pods, así que la comparación es una hoja de cálculo, no una migración.