MULTISTATUS научился круглосуточно следить за сайтами и считать SLA

MULTISTATUS научился круглосуточно следить за сайтами и считать SLA

MULTISTATUS научился круглосуточно следить за сайтами и считать SLA

Компания МУЛЬТИФАКТОР выпустила крупное обновление сервиса распределённого мониторинга MULTISTATUS. В новой версии добавили непрерывный контроль интернет-ресурсов, публичные статусные страницы, встроенный расчёт SLA, расширенную географию проверок и более гибкие уведомления об инцидентах.

Одно из главных изменений — возможность перевести ресурсы с разовых проверок на постоянный мониторинг.

Теперь сервис может круглосуточно отслеживать состояние сайтов, сервисов и отдельных элементов инфраструктуры. Доступны проверки HTTP/HTTPS, Ping, TCP-портов, SSL-сертификатов и доменов.

В MULTISTATUS также появился инструмент автоматического обнаружения веб-ресурсов. На этапе пилотного внедрения специалисты анализируют связанную инфраструктуру заказчика — домены и поддомены, — определяют, какие ресурсы стоит поставить на контроль, и готовят рекомендации по настройке. Такой подход должен сократить время запуска мониторинга и уменьшить объём ручной настройки. Позже инструмент планируют сделать отдельной автоматической опцией.

Ещё одно заметное обновление — встроенный механизм расчёта SLA. Сервис рассчитывает показатели доступности на основе настроенных правил инцидентов, позволяет смотреть статистику за разные периоды, отслеживать простой и выводить данные на настраиваемые дашборды.

Расширилась и география мониторинга. Теперь проверки выполняются из восьми локаций в России, Казахстане и Европе. Для заказчиков также появилась возможность подключать собственные точки проверки. Это помогает быстрее замечать региональные проблемы: например, сбои у операторов связи или ухудшение доступности сервиса в отдельных сегментах сети.

В новой версии появились публичные статусные страницы. Их можно использовать, чтобы показывать клиентам и партнёрам текущее состояние сервисов и показатели доступности. В дальнейшем разработчики планируют добавить возможность размещать такие страницы на собственном домене компании.

Отдельно обновили систему уведомлений. Оповещения теперь можно группировать по ресурсам и сценариям инцидентов, а отправлять их — по электронной почте, в Telegram или через голосовые звонки дежурным специалистам. Это позволяет разделять реакции на разные типы событий: например, незначительные сбои отправлять в мессенджер, а критичные инциденты сразу передавать дежурной команде.

Кроме того, в MULTISTATUS запустили личный кабинет администратора. В нём можно управлять ресурсами, мониторингом, дашбордами, правилами инцидентов и API-интеграциями из одного интерфейса.

Также компания обновила сайт сервиса и изменила тарифную модель. Теперь стоимость рассчитывается исходя из количества контролируемых ресурсов, частоты проверок и их географии.

MULTISTATUS использует сеть мониторинговых агентов, размещённых в разных дата-центрах и регионах. За счёт этого сервис оценивает доступность инфраструктуры не только изнутри, но и с точки зрения конечного пользователя в разных локациях.

GitHub лёг почти целиком: ошибки затронули API, Actions и Copilot

17 августа GitHub столкнулся с глобальным сбоем, затронувшим почти все основные функции платформы. Разработчики жаловались на проблемы с веб-интерфейсом, API, Issues, Pull Requests, Actions, Webhooks, Pages, Git Operations и Copilot. В разгар инцидента около 20% запросов к сайту и API завершались ошибками.

При загрузке архивов и необработанного содержимого репозиториев показатель доходил примерно до 50%.

Также пострадали корпоративные механизмы аутентификации SAML и OIDC, службы SCIM и Team Sync.

Первые признаки деградации GitHub зафиксировал около 13:40 UTC. Затем список затронутых компонентов начал расти: проблемы последовательно появились у API Requests, Actions, Webhooks, Issues, Pull Requests, Copilot, Pages и операций Git. Codespaces при этом продолжал работать штатно.

Команда обнаружила проблемный компонент и приняла меры. Согласно последнему сообщению от GitHub, сервисы постепенно восстанавливаются, однако уровень ошибок всё ещё немного превышает норму. Полностью закрывать инцидент компания пока не стала. Актуальный статус GitHub можно посмотреть по этой ссылке.

Параллельно пользователи сообщали о неполадках в других сервисах экосистемы Microsoft, включая Teams и Copilot. Эксперты предположили связь происходящего с сетевыми проблемами Amazon Web Services, однако GitHub официально эту версию не подтверждал и первопричину ещё не раскрыл.

RSS: Новости на портале Anti-Malware.ru