28 horas sin AWS y 13 incidentes de Cloudflare en ocho días: por qué su empresa necesita monitoreo propio

Sala de control con varias pantallas de monitoreo de sistemas, la vigilancia que detecta una caída antes que el cliente

Las caídas de servicios en la nube dejaron de ser una anécdota anual. En lo que va de 2026 se acumulan episodios que afectaron a decenas de miles de organizaciones, y la conclusión para una empresa mediana no es «hay que salir de la nube». Es otra, más incómoda: el proveedor no va a avisarle a tiempo.

AWS: 28 horas por un fallo de refrigeración

Entre el 7 y el 8 de mayo de 2026, la región us-east-1 de AWS —concretamente la zona de disponibilidad use1-az4, en el norte de Virginia— sufrió una interrupción de aproximadamente 28 horas. La causa no fue un ciberataque ni un error de software, sino algo mucho más físico. Según la explicación de AWS:

«Múltiples unidades de refrigeración fallaron dentro de una única sala del centro de datos que da servicio a use1-az4 a última hora del 7 de mayo. A medida que la sala se calentó por encima de los umbrales de operación seguros, los servidores se apagaron automáticamente para proteger el hardware.»

Amazon Web Services

El impacto directo alcanzó a instancias EC2 y volúmenes EBS, y de ahí se propagó en cascada a nueve servicios más: ELB, EKS, Redshift, MSK, ElastiCache, OpenSearch, SageMaker, IoT Core y NAT Gateway.

Entre los afectados hubo nombres conocidos: Coinbase estuvo con sus sistemas de negociación fuera de servicio unas siete horas, FanDuel no pudo procesar retiros durante un partido de la NBA y la herramienta institucional CME Direct mostró errores. Se estima que más de 70.000 organizaciones se vieron afectadas. Fue el tercer fallo mayor de us-east-1 desde diciembre de 2021.

Cloudflare: trece incidentes en ocho días

Entre el 7 y el 14 de agosto de 2026, Cloudflare registró 13 incidentes —doce menores y uno mayor—, con una media superior a 1,6 por día. Tocaron el almacenamiento de objetos R2, Durable Objects, Workers KV, Workers AI, Magic Transit y la seguridad de correo, en varias regiones.

El del 7 de agosto es el más ilustrativo: un fallo de disponibilidad de escritura en R2 en el este de Norteamérica durante 2 horas y 10 minutos. Al menos un cliente reportó unos 67 GB sin restaurar días después.

El dato que da escala al asunto: a finales de julio de 2026, Cloudflare actuaba como proxy inverso del 24,2 % de todos los sitios web. Cuando falla, no falla un proveedor: falla una porción de internet.

Y no son los únicos

Google Cloud sumó su propio episodio en 2026, con 33 servicios caídos durante 2 horas y 22 minutos. Azure había tenido, el 24 de abril, un problema de plano de control en East US que se prolongó más de 12 horas y afectó a varias zonas de disponibilidad.

La concentración es el problema de fondo: un 81 % de las organizaciones encuestadas afirma que sufriría una disrupción grave o crítica ante un apagón de una semana en un único proveedor.

Lo que sí está en su mano

Ninguna empresa mediana va a impedir que falle la refrigeración de una sala en Virginia. Pero hay una diferencia enorme entre enterarse por el monitoreo y enterarse por un cliente enfadado:

  • Monitoree el servicio, no el servidor. Que la máquina responda al ping no dice nada. Lo que importa es si el usuario puede facturar, consultar o autenticarse.
  • Vigile desde fuera. Un monitoreo que vive dentro de la misma infraestructura que está cayendo se cae con ella.
  • Sepa qué depende de qué. Muchas empresas descubrieron en mayo que un servicio propio dependía de us-east-1 sin que nadie lo hubiera documentado.
  • Defina qué se hace mientras dura. Un procedimiento manual acordado vale más que un plan de alta disponibilidad que nunca se probó.
  • Tenga a quién avisar y con qué texto. Comunicar a tiempo a los clientes es la mitad del daño evitado.

Las caídas de 2026 no demuestran que la nube sea mala idea. Demuestran que delegar la infraestructura no es lo mismo que delegar la responsabilidad de saber cómo está.

Fuentes consultadas

Compartir este artículo

Últimas entradas

Escríbanos ahora