⚠️ Авария во Франкфурте: что известно на данный момент
Зоны: de-1
Тип:❗️Major
Рассказываем подробно, что происходит и почему.
Что произошло
Авария случилась не на нашей площадке, а на промежуточном узле — в дата-центре Equinix FR5 во Франкфурте. Это один из крупнейших телеком-хабов Европы, и через него проходят все наши каналы связи до площадки, где размещены серверы de-1. Само оборудование с вашими данными не пострадало — потеряна сетевая связность.
По информации от площадки, в FR5 дала течь труба системы охлаждения машинных залов. Протечка затронула все системы охлаждения здания, температура поднялась выше 50 °C, сработала система пожаротушения, и сетевое оборудование начало массово отключаться. Дополнительно мы фиксируем множественные аварии на каналах и магистралях в регионе.
Таймлайн по мск
05:33 — AWS фиксирует первые потери пакетов на линках через FR5
05:41 — в FR5 обнаружена протечка трубы системы охлаждения
06:32 — магистральный оператор Core-Backbone фиксирует рост температуры в залах
07:25 — критическая температура, массовые обрывы связи по всему ДЦ
07:26 — утечка локализована, начата заправка контура охлаждения
08:09 — значительная часть оборудования в ДЦ отключилась
09:38 — в залах работают осушители, идёт откачка воды
10:30 — на площадку прибыли инженеры вендоров чиллеров и противопожарной системы
Сейчас план у Equinix такой: продуть контур охлаждения от воздуха и по одному тестово запускать чиллеры. Доступ к оборудованию в пострадавших залах пока закрыт — там вода и оборудование под напряжением.
Это глобальный сбой, не только у нас
FR5 — точка присутствия десятков операторов, и авария ударила по многим:
• AWS официально подтверждает деградацию Direct Connect в eu-central-1 из-за «инфраструктурной проблемы на площадке Equinix FR5» и оценивает восстановление в «multiple hours»: health.aws.amazon.com/health/status
• Core-Backbone потерял в FR5 четыре узла, публикует детальный отчёт: status.core-backbone.com/index.php?id=6709
• SMARTNET подтверждает недоступность ряда операторов в FR5, включая магистрального RETN: status.as203446.net/item.php?id=10
• На allestörungen.de (немецкий Downdetector) — всплеск жалоб на провайдеров по всей Германии.
Когда всё заработает
Точного ETR у поставщиков пока нет — он появится после того, как ДЦ восстановит охлаждение и откроет доступ к оборудованию. Наши инженеры на связи с партнёрами и готовы приступить к проверке связности сразу после восстановления узла.
Будем публиковать апдейты по мере поступления информации.
Зоны: de-1
Тип:❗️Major
Рассказываем подробно, что происходит и почему.
Что произошло
Авария случилась не на нашей площадке, а на промежуточном узле — в дата-центре Equinix FR5 во Франкфурте. Это один из крупнейших телеком-хабов Европы, и через него проходят все наши каналы связи до площадки, где размещены серверы de-1. Само оборудование с вашими данными не пострадало — потеряна сетевая связность.
По информации от площадки, в FR5 дала течь труба системы охлаждения машинных залов. Протечка затронула все системы охлаждения здания, температура поднялась выше 50 °C, сработала система пожаротушения, и сетевое оборудование начало массово отключаться. Дополнительно мы фиксируем множественные аварии на каналах и магистралях в регионе.
Таймлайн по мск
05:33 — AWS фиксирует первые потери пакетов на линках через FR5
05:41 — в FR5 обнаружена протечка трубы системы охлаждения
06:32 — магистральный оператор Core-Backbone фиксирует рост температуры в залах
07:25 — критическая температура, массовые обрывы связи по всему ДЦ
07:26 — утечка локализована, начата заправка контура охлаждения
08:09 — значительная часть оборудования в ДЦ отключилась
09:38 — в залах работают осушители, идёт откачка воды
10:30 — на площадку прибыли инженеры вендоров чиллеров и противопожарной системы
Сейчас план у Equinix такой: продуть контур охлаждения от воздуха и по одному тестово запускать чиллеры. Доступ к оборудованию в пострадавших залах пока закрыт — там вода и оборудование под напряжением.
Это глобальный сбой, не только у нас
FR5 — точка присутствия десятков операторов, и авария ударила по многим:
• AWS официально подтверждает деградацию Direct Connect в eu-central-1 из-за «инфраструктурной проблемы на площадке Equinix FR5» и оценивает восстановление в «multiple hours»: health.aws.amazon.com/health/status
• Core-Backbone потерял в FR5 четыре узла, публикует детальный отчёт: status.core-backbone.com/index.php?id=6709
• SMARTNET подтверждает недоступность ряда операторов в FR5, включая магистрального RETN: status.as203446.net/item.php?id=10
• На allestörungen.de (немецкий Downdetector) — всплеск жалоб на провайдеров по всей Германии.
Когда всё заработает
Точного ETR у поставщиков пока нет — он появится после того, как ДЦ восстановит охлаждение и откроет доступ к оборудованию. Наши инженеры на связи с партнёрами и готовы приступить к проверке связности сразу после восстановления узла.
Будем публиковать апдейты по мере поступления информации.
😱196❤54🙏33😢25👍12🔥5👌5❤🔥1
⚠️ Авария во Франкфурте: дата-центр восстанавливает охлаждение и питание
Зоны: de-1
Тип:❗️Major
Делимся свежей информацией с площадки:
• На третьем этаже ДЦ охлаждение восстановлено: запущены три чиллера, для подстраховки развёрнуты временные холодильные установки, на площадку везут дополнительные.
• На первом и втором этажах работы продолжаются: бригады проверяют герметичность системы и постепенно возвращают подачу охлаждённой воды.
• В стойки начали поэтапно подавать питание.
• Наш опорный коммутатор уже доступен
Что дальше
Ждём, когда поднимутся стойки операторов связи в ДЦ. Как только оборудование будет запущено, связность до площадки с серверами de-1 восстановится.
Операторы уже в процессе — например, RETN сообщает, что их инженер получил доступ в машинный зал и началось включение оборудования.
Точное время назвать пока не можем — питание на стойки части операторов ещё не подано.
Зоны: de-1
Тип:❗️Major
Делимся свежей информацией с площадки:
• На третьем этаже ДЦ охлаждение восстановлено: запущены три чиллера, для подстраховки развёрнуты временные холодильные установки, на площадку везут дополнительные.
• На первом и втором этажах работы продолжаются: бригады проверяют герметичность системы и постепенно возвращают подачу охлаждённой воды.
• В стойки начали поэтапно подавать питание.
• Наш опорный коммутатор уже доступен
Что дальше
Ждём, когда поднимутся стойки операторов связи в ДЦ. Как только оборудование будет запущено, связность до площадки с серверами de-1 восстановится.
Операторы уже в процессе — например, RETN сообщает, что их инженер получил доступ в машинный зал и началось включение оборудования.
Точное время назвать пока не можем — питание на стойки части операторов ещё не подано.
🙏89👌27😢20🔥17❤12👍8
✅ Авария во Франкфурте: инцидент закрыт
Зоны: de-1
Тип:❗️Major
Стойки операторов связи запущены, связанность до площадки в Германии восстановлена.
Зоны: de-1
Тип:❗️Major
Стойки операторов связи запущены, связанность до площадки в Германии восстановлена.
👍103❤32👏22🔥8😢6❤🔥5👌4😱2
В телеграм-каналах и на даундетекторах появились сообщения о сбоях у ряда крупных сервисов и о проблемах с питанием на московских узлах связи, включая ММТС-9. Из-за этого могут быть перебои у некоторых операторов, хостингов и популярных приложений.
Наша сеть не затронута, все регионы и сервисы работают штатно.
Если заметите проблемы с доступом к своим сервисам — скорее всего, дело в связности на стороне интернет-провайдера.
Наша сеть не затронута, все регионы и сервисы работают штатно.
Если заметите проблемы с доступом к своим сервисам — скорее всего, дело в связности на стороне интернет-провайдера.
❤124👍66🔥21😢18😱10❤🔥2
🛑 Сетевая недоступность в Нидерландах
Зона: ams-1
Тип:❗️Major
Наблюдаем недоступность сервисов в Нидерландах. Уточняем подробности.
Зона: ams-1
Тип:❗️Major
Наблюдаем недоступность сервисов в Нидерландах. Уточняем подробности.
😢265😱80🔥21👏11🎉8❤6👍4👌4❤🔥1🙏1
Timeweb Cloud Alerts
🛑 Сетевая недоступность в Нидерландах Зона: ams-1 Тип:❗️Major Наблюдаем недоступность сервисов в Нидерландах. Уточняем подробности.
⚠️ Обновление по инциденту
Зоны: ams-1
Тип:❗️Major
Сетевое оборудование в Нидерландах перестало отвечать, отправили в принудительную перезагрузку. Ориентировочное время восстановления в течение 20 минут.
Зоны: ams-1
Тип:❗️Major
Сетевое оборудование в Нидерландах перестало отвечать, отправили в принудительную перезагрузку. Ориентировочное время восстановления в течение 20 минут.
🎉86😱34🙏16❤15👍9🔥7👌7😢5
Timeweb Cloud Alerts
⚠️ Обновление по инциденту Зоны: ams-1 Тип:❗️Major Сетевое оборудование в Нидерландах перестало отвечать, отправили в принудительную перезагрузку. Ориентировочное время восстановления в течение 20 минут.
✅ Инцидент закрыт
Зоны: ams-1
Тип:❗️Major
Сетевая доступность восстановлена в 16:18 мск. Оборудование работает в штатном режиме.
Зоны: ams-1
Тип:❗️Major
Сетевая доступность восстановлена в 16:18 мск. Оборудование работает в штатном режиме.
🔥128❤43🎉15❤🔥6👍6😢4
⚠️ Плановые работы в ams-1: замена чиллера
Зоны: ams-1
Тип: плановые работы
Завтра, 11 сентября, в дата-центре Qupra пройдут работы по обслуживанию чиллера. Большую часть серверов ams-1 мы уже перевезли в новый дата-центр NorthC — их работы не затронут.
На время работ площадка перейдет на Free Cooling охлаждение. Чтобы минимизировать риски, мы ограничим энергопотребление оборудования, поэтому возможно временное снижение производительности размещенных в Qupra серверов.
Зоны: ams-1
Тип: плановые работы
Завтра, 11 сентября, в дата-центре Qupra пройдут работы по обслуживанию чиллера. Большую часть серверов ams-1 мы уже перевезли в новый дата-центр NorthC — их работы не затронут.
На время работ площадка перейдет на Free Cooling охлаждение. Чтобы минимизировать риски, мы ограничим энергопотребление оборудования, поэтому возможно временное снижение производительности размещенных в Qupra серверов.
👌86😱36❤12🔥5😢3🙏2👏1
🛑 Сетевая недоступность в Москве
Зона: msk-1
Тип:❗️Major
Наблюдается недоступность части сервисов в Москве. Оцениваем масштаб, скоро вернёмся с апдейтом.
Зона: msk-1
Тип:❗️Major
Наблюдается недоступность части сервисов в Москве. Оцениваем масштаб, скоро вернёмся с апдейтом.
😱195😢64🙏12👍8❤6🔥4🎉1
Timeweb Cloud Alerts
🛑 Сетевая недоступность в Москве Зона: msk-1 Тип:❗️Major Наблюдается недоступность части сервисов в Москве. Оцениваем масштаб, скоро вернёмся с апдейтом.
⚠️ Обновление по инциденту
Зона: msk-1
Тип:❗️Major
По уточнённой информации, был недоступен роутер в Москве, переключились на резерв. Может наблюдаться частичная недоступность в других зонах РФ.
Инженеры продолжают диагностику оборудования. Следующий апдейт через 30 минут.
Зона: msk-1
Тип:❗️Major
По уточнённой информации, был недоступен роутер в Москве, переключились на резерв. Может наблюдаться частичная недоступность в других зонах РФ.
Инженеры продолжают диагностику оборудования. Следующий апдейт через 30 минут.
😱68👍21🙏18😢16❤7👌5
Timeweb Cloud Alerts
⚠️ Обновление по инциденту Зона: msk-1 Тип:❗️Major По уточнённой информации, был недоступен роутер в Москве, переключились на резерв. Может наблюдаться частичная недоступность в других зонах РФ. Инженеры продолжают диагностику оборудования. Следующий апдейт…
⚠️ Обновление по инциденту
Зона: msk-1
Тип:❗️Major
Восстановительные работы продолжаются. Инженеры переключают control plane после холодного рестарта.
В ближайшие 15 минут может наблюдаться ухудшение ситуации с доступностью сервисов.
Следующий апдейт в 13:00.
Зона: msk-1
Тип:❗️Major
Восстановительные работы продолжаются. Инженеры переключают control plane после холодного рестарта.
В ближайшие 15 минут может наблюдаться ухудшение ситуации с доступностью сервисов.
Следующий апдейт в 13:00.
😢48🙏27😱18❤🔥2👌2❤1
Timeweb Cloud Alerts
⚠️ Обновление по инциденту Зона: msk-1 Тип:❗️Major Восстановительные работы продолжаются. Инженеры переключают control plane после холодного рестарта. В ближайшие 15 минут может наблюдаться ухудшение ситуации с доступностью сервисов. Следующий апдейт в…
✅ Инцидент закрыт
Зоны: msk-1
Тип:❗️Major
Сетевая доступность восстановлена в 12:55 мск. Оборудование работает в штатном режиме.
Зоны: msk-1
Тип:❗️Major
Сетевая доступность восстановлена в 12:55 мск. Оборудование работает в штатном режиме.
👍78🎉38🔥13❤🔥8❤6🙏3
Timeweb Cloud Alerts
⚠️ Плановые работы в ams-1: замена чиллера Зоны: ams-1 Тип: плановые работы Завтра, 11 сентября, в дата-центре Qupra пройдут работы по обслуживанию чиллера. Большую часть серверов ams-1 мы уже перевезли в новый дата-центр NorthC — их работы не затронут.…
⚠️ Плановые работы в ams-1: замена чиллера
Зона: ams-1
Тип: плановые работы
Завтра, 17 сентября, в дата-центре Qupra пройдет второй этап работ с системой охлаждения: текущий чиллер заменят на новый. Переключение на него ожидается около 14:00 мск. Большую часть серверов ams-1 мы уже перевезли в новый дата-центр NorthC, их работы не затронут.
Простоя охлаждения не планируется: текущий чиллер остается в резерве на все время монтажа нового. Чтобы минимизировать риски, мы ограничим энергопотребление оборудования — возможно временное снижение производительности размещенных в Qupra серверов.
Зона: ams-1
Тип: плановые работы
Завтра, 17 сентября, в дата-центре Qupra пройдет второй этап работ с системой охлаждения: текущий чиллер заменят на новый. Переключение на него ожидается около 14:00 мск. Большую часть серверов ams-1 мы уже перевезли в новый дата-центр NorthC, их работы не затронут.
Простоя охлаждения не планируется: текущий чиллер остается в резерве на все время монтажа нового. Чтобы минимизировать риски, мы ограничим энергопотребление оборудования — возможно временное снижение производительности размещенных в Qupra серверов.
🙏47👍19😱7👌7❤6🔥4🎉1