Перезапустить недостаточно: как я сделал проверяемое автоматическое восстановление сервисов
restart-hook вернул 202, а сервис всё ещё не отвечает. Повторить запрос — рискнуть вторым перезапуском; закрыть инцидент — записать восстановление,…
Tech news from the best sources
restart-hook вернул 202, а сервис всё ещё не отвечает. Повторить запрос — рискнуть вторым перезапуском; закрыть инцидент — записать восстановление,…
Сделал сервис по мониторингу. Через полгода заглянул кто им пользуется — а там думская партия, финансы целого региона, чужие прокси и один сайт из ф…
TL;DR. Я выбирал Timeweb не из-за цены, а из-за «имени» и обещанной надёжности. За май–июнь 2026 года зона ams-1 (Амстердам, дата-центр Qupra) переж…
В прошлый раз я писал про рекурсивную задачу мониторинга : кто мониторит монитор? Если Prometheus упал — вы не видите ничего, и самое коварное тут в…
В этой статье я расскажу, на какие подводные камни я споткнулся при разработке своего пет‑проекта — мониторинга сайтов на G…
Я делаю Valpero — uptime-мониторинг с проверками из 10 регионов мира. Когда я только собирал probe-сеть, я был уверен, что 10 географических точек э…
К-of-N или all-must-agree? Два подхода к quorum-логике в multi-region мониторинге. Я остановился на all-must-agree с consecutive-failure threshold.…