Cargas con estado en Kubernetes, y la pregunta que deberías hacerte primero
Un StatefulSet garantiza menos de lo que se supone, un volumen ancla un pod a una zona, y la pregunta honesta es si esa base de datos debería estar en el clúster siquiera.
Artículos sobre Plataforma de datos en el blog de ConsultorIA: cloud, IA aplicada y seguridad en producción.
Un StatefulSet garantiza menos de lo que se supone, un volumen ancla un pod a una zona, y la pregunta honesta es si esa base de datos debería estar en el clúster siquiera.
Una reparte trabajo y lo olvida. El otro es un registro ordenado que varios consumidores pueden releer. Elegir el equivocado produce una arquitectura que te pelea durante años.
Casi todos los incidentes de rendimiento que investigamos son un índice que falta, una reserva de conexiones que no existe, o un autovacío dimensionado para una base de datos diez veces menor. Agrandar la instancia es lo primero que prueba la gente y casi nunca es la respuesta.
Los formatos de tabla abiertos cambiaron la negociación al separar el almacenamiento del cómputo. Lo que queda por decidir es tu mezcla de cargas, tu frontera de gobernanza y qué modelo de coste puedes controlar de verdad.
La invalidación, la estampida y el día que la caché se llena son los tres. Un tiempo de vida es la respuesta aburrida y correcta al primero, y la mayoría de los problemas de caché resultan ser un índice que falta.
Airflow debería planificar y coordinar, nunca procesar. dbt debería transformar dentro del almacén con pruebas asociadas. El fallo que más cuesta es la calidad de datos que nadie comprobó hasta que un panel llevaba un trimestre equivocado.