Contenido Archivado

El siguiente contenido es de una versión anterior de este sitio web y es posible que no se muestre correctamente.
La compañía de Internet Amazon se ha disculpado por los problemas causados debido al funcionamiento defectuoso de uno de sus centros de datos. Los fallos detectados impidieron el normal funcionamiento de páginas web como Foursquare, Quora o HootSuite, y ha asegurado que aplicará, de forma automática, un crédito de diez días de uso de sus servicios a todos los clientes -perjudicados o no- de la zona afectada por el apagón de la red. Amazon no aclaró cuántos son.
 
Los problemas comenzaron alrededor de las 12:45 horas del pasado 21 de abril hasta las 15:00 horas del día 24.En el último comunicado, la empresa estadounidense ha asegurado que ha solucionado ya "completamente la funcionalidad de los servicios afectados".
 
La caída se produjo en un centro de datos a las afueras de Washington. Según un informe de Amazon, las dificultades técnicas ocurridas se atribuyen a un error humano tras un cambio rutinario en la configuración de su red. Este cambio se realizó incorrectamente en la madrugada del 21 de abril y provocó que muchas computadoras quedaran atascadas en una etapa de la recuperación.
 
La situación perjudicó a una gran cantidad de empresas que alquilan espacio en los centros de datos de Amazon para operar en la nube, tales como el servicio de preguntas y respuestas Quora, la red social de localización Foursquare o la herramienta HootSuite para gestionar redes sociales.
 
El servicio de Amazon está dispuesto de manera que suministre redundancias, permitiendo que servidores de otras zonas sustituyan a las que fallan. La compañía afirma que los clientes que estaban repartidos por zonas múltiples casi no se vieron afectados, pero que el error dificultó hacer cambios de zona repentinos.
 
Actualmente, la empresa estadounidense trabaja para impedir que el problema se repita. Una de las acciones propuestas es cambiar los procesos de planificación de capacidad, ya que los ingenieros de la compañía descubrieron durante el incidente que se necesita más capacidad extra para hacer frente a interrupciones de esta escala con mayor eficacia.
La compañía tiene previsto centrarse en facilitar a sus clientes la construcción de aplicaciones en múltiples zonas y en usar la redundancia para mantener la disponibilidad de las aplicaciones en caso de fallo en una de ellas.
 
Para ello se incluye la creación de mejores herramientas para su implementación y una serie de seminarios gratuitos que se centrarán en el diseño de aplicaciones con tolerancia a fallos para la infraestructura basada en la nube.
 
Este corte de servicio de nube de Amazon resalta cuáles son los puntos vulnerables de este tipo de servicios, y la importancia de contar con copias de seguridad de datos y aplicaciones.