A las 6:40 de esta mañana, hora del Este, la gente empezó a acercar sus teléfonos a la caja registradora y no pasó nada.
Apple Pay dejó de funcionar. DoorDash dejó de funcionar. Reddit, Hulu, PlayStation… todo se fue al traste. No porque esas empresas hubieran hecho nada mal, sino porque una sola región de Amazon Web Services en Oregón dio un tropiezo.
AWS no admitió oficialmente nada hasta las 4:40 de la madrugada, hora del Pacífico —es decir, las 7:40, hora del Este—, una hora completa después de que Downdetector diera la voz de alarma. Anunciaron que el problema se había resuelto poco después de las 9 de la mañana, hora del Este.
Dos horas y veinte minutos, más o menos.
Y la mayoría de la gente va a leer esa cifra y pensar que significa que todo va bien.
¿Qué fue lo que realmente colapsó Internet esta vez?
La avería afectó a la región US-West-2 de AWS, situada en Oregón. Amazon comenzó indicando cinco servicios afectados y, posteriormente, amplió discretamente la lista a siete: Direct Connect, Global Accelerator, Internet Connectivity, IoT Core, API Gateway, Elastic Compute Cloud y Elastic Container Service.
Esa lista es importante, así que aquí la tienes en inglés.
EC2 son los servidores virtuales en los que se ejecutan realmente tus aplicaciones. API Gateway es el centro de conmutación que permite que los distintos sistemas se comuniquen entre sí. Direct Connect y la conectividad a Internet son las vías de entrada y salida de la región. Global Accelerator elige la ruta más rápida para llevarte hasta allí.
Cuando cinco de las siete cosas que han fallado tienen que ver con la infraestructura técnica y no con los productos, no se trata de un simple servidor averiado. Se trata de un fallo simultáneo en varias capas de una red regional. Amazon lo ha calificado como «afectado», lo cual es la forma corporativa de decir: sí, esto es real, por favor, dejad de enviarnos correos electrónicos.
El desglose de Downdetector fue desolador. Aproximadamente el 30 % de las quejas sobre AWS apuntaban a EC2. Otro 29 % mencionaba específicamente la región US-West-2. Y el 23 % procedía de la región US-East-1, en el norte de Virginia, que es una región totalmente diferente, al otro lado del continente.
Vuelve a leer esa última parte. El fallo se produjo en Oregón y casi una cuarta parte de los problemas se manifestaban en Virginia.
Octubre fue Virginia. Julio fue Oregón. Nadie solucionó el problema de verdad.
Hace nueve meses escribí El día en que se colapsó Internet después de que AWS desactivara la región US-East-1 a las 3:11 de la madrugada y arrastrara consigo a Snapchat, Signal, Roblox, los sistemas de facturación de las aerolíneas, los bancos y las cámaras Ring. Fallos en la red interna y en el DNS. Una empresa, un error, y la mitad de Internet se ha visto afectada.
La respuesta del sector consistió en numerosas entradas de blog sobre la arquitectura multirregional y exactamente cero cambios estructurales.
Amazon sigue gestionando aproximadamente un tercio de la infraestructura global en la nube. Si a eso le sumamos Microsoft y Google, llegamos a que aproximadamente el 70 % de Internet se aloja en el hardware de estas tres empresas. Tu banco, las imágenes de tu cámara de seguridad, tu portal médico, la aplicación del colegio de tus hijos y el terminal de pago de la gasolinera alquilan espacio en ese mismo puñado de centros de datos.
Eso no es una red. Es un cuello de botella con buen marketing.
Lo que debería darte miedo es precisamente el hecho de que no se utilice dinero en efectivo
Olvídate de que Reddit haya estado fuera de servicio durante dos horas. Nadie se ha muerto por no poder desplazarse por la página.
Apple Pay se ha caído. Ese es.
Hay mucha gente por ahí ahora mismo sin dinero en efectivo en el bolsillo, sin tarjeta de repuesto, nada más que un teléfono y mucha fe. Esta mañana, durante dos horas, esas personas no pudieron comprar nada. Ni gasolina, ni comida, ni siquiera una botella de agua. El dinero seguía estando en la cuenta. Simplemente no se podía acceder a ella.
Ahora imagina que eso pasa de ser dos horas a dos días y pregúntate cómo quedaría tu ciudad.
Ya hemos insistido en esto antes en Por qué los «preppers» deberían preocuparse seriamente por una sociedad sin dinero en efectivo, y cada interrupción del servicio como esta viene a demostrar lo mismo. No hace falta que el sistema sea objeto de un ataque informático, que sea confiscado o que se utilice con fines maliciosos para impedirte acceder a tu propio dinero. Basta con que tenga una mala mañana de viernes.
Si un fallo técnico de una empresa puede bloquear tu capacidad de pago durante dos horas, una moneda digital del Banco Central puede bloquearla durante el tiempo que alguien de arriba decida que te mereces.
Ha sido un accidente… Pero, ¿eso lo hace menos preocupante?
Esto es lo que me quita el sueño.
Esta mañana ha sido un error. Un cambio en la configuración, un fallo de hardware, una tabla de enrutamiento que se ha descarrilado. Sin malicia, sin coordinación, sin adversario. Y aun así ha dejado fuera de servicio los pagos, el reparto de comida a domicilio y los videojuegos para millones de personas en todo el país antes de que la mayoría de ellas se hubiera terminado su primera taza de café.
Más del 85 % de las infraestructuras críticas estadounidenses son de propiedad privada. Los bancos, las telecomunicaciones, la red eléctrica, los centros de datos… todo ello está en manos de empresas, con una supervisión irregular y unos presupuestos de seguridad que se recortan cada vez que los beneficios no alcanzan las expectativas.
Ahora imagina que alguien hace esto a propósito, en tres regiones a la vez, un lunes, coordinándolo con algún otro evento. Los sistemas de pago se colapsan. Las comunicaciones se deterioran. La logística se paraliza. Las tiendas de alimentación suelen tener existencias para unas 72 horas en el mejor de los casos, y eso suponiendo que los camiones sigan circulando y las cajas registradoras sigan funcionando.
No hace falta que todo se vaya al garete de golpe. Solo tiene que quedarse parado durante cuatro o cinco días.
Ya hemos tratado el aspecto físico de este tema en Dos informes del Gobierno, una respuesta: la red eléctrica se quedará sin capacidad en 2029 y La alerta del DHS sobre la red eléctrica que Washington quiere que olvides. La misma historia, pero con otros medios. Todo está centralizado, todo es frágil, y todos los responsables confían en que nada salga mal dos veces en el mismo día.
Qué haces realmente al respecto
Para nada de esto hace falta un búnker.
Lleva dinero en efectivo. Billetes de verdad, de baja denominación, en tu cartera, hoy mismo. Unos doscientos en casa, en un lugar seguro. Esta mañana se ha demostrado perfectamente por qué es necesario en ciento cuarenta minutos.
Ten a mano un segundo método de pago que no pase por tu móvil. Una tarjeta física, de un banco distinto al que utilizas habitualmente, no es ningún lujo.
Saca de la nube lo que sea importante y guárdalo en un dispositivo que sea de tu propiedad. Documentos, fotos, historiales médicos, pólizas de seguro, números de contacto. Un disco duro externo cuesta menos que una cena decente fuera de casa. Imprime la lista de contactos. El papel no necesita una región.
Compra mapas en papel de tu zona y de las rutas que realmente vas a recorrer. El sistema de navegación de tu móvil depende de un servidor ajeno.
Hay una forma de obtener información cuando las aplicaciones se cierran. La radioafición sigue siendo la solución, y sigue siendo lo que la mayoría de la gente deja para más adelante. Empieza por Comunicaciones de emergencia cuando todo se vaya al garete y el Guía rápida de radioaficionados.
Ocúpate de los cuatro aspectos básicos: agua, comida, alojamiento y protección. Si los tienes controlados, ya vas por delante de casi todo el mundo de tu código postal. Introducción a la preparación para emergencias te guía paso a paso si empiezas desde cero.
Entonces siéntate y ejecuta un verdadero Evaluación de amenazas en función de tu situación particular, ya que una interrupción del servicio en la nube afecta de forma totalmente diferente a una vivienda rural y a un piso en el centro de la ciudad.
Amazon publicará un análisis a posteriori dentro de una o dos semanas. Estará bien redactado, será técnicamente honesto y estará repleto de referencias a la mejora de la supervisión y las pruebas de resiliencia. Todo el mundo asintirá con la cabeza y volverá a desarrollar sus soluciones basándose en los mismos siete servicios en los centros de datos de las mismas tres empresas.
Y alguna mañana que no sea un viernes de julio, la reparación no llegará antes de las nueve.
Artículos relacionados:
El día en que Internet dejó de funcionar: la prueba de que estamos a un solo fallo técnico del caos Por qué los «preppers» deberían preocuparse seriamente por una sociedad sin dinero en efectivo La teoría de la «muerte de Internet»: los bots de IA ya superan en número a los humanos en la red Preparación ante un pulso electromagnético: cómo prepararse para un ataque con pulso electromagnético Información situacional: el conocimiento es poder durante una crisis La guía definitiva de supervivencia en situaciones de emergencia Prepper Radio: La guía de preparación para el examen de técnico de radioaficionado sin tonterías
Fuente original (en inglés): Activist Post