RU

Правильный код мы отклоняем — и так задумано

Мой валидатор забраковал ответ, сославшись на несуществующую статью, — а ведь именно он поставлен ловить галлюцинации. После этого я собрал конвейер…

LLMгаллюцинациивалидацияllm-судьиpydanticконформное предсказаниеMAPIEragнадежностьпайплайн
Habr
RU

Как мониторить Java-приложения: метрики, алерты и правило 80/20

Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё:…

мониторингметрикиалертингjavadevopssresite reliability engineeringнадежностьинцидент-менеджмент
Habr
RU

Механику на насос деньги дали, а вам на серверную — нет. Дело не в железе, а в языке

Как обосновать ИТ-бюджет через FMEA и RCM — методологию надёжности, которой на предприятии уже доверяют Читать далее

fmearcmнадежностьит-бюджетуправление активамиiso 55001тоирскрытые отказыит-директорпромышленный ит
Habr
RU

Мы чинили инциденты всё быстрее — а недовольство клиентов росло. Почему MTBF важнее MTTR

Инцидентов стало в два раза больше. Время восстановления сократилось вдвое. Uptime сервисов держался в норме. По всем ключевым метрикам мы становили…

mtbfmttrsreнадежностьметрикиинцидентыуправление разработкой
Хабр — Управление
RU

Ваши постмортемы — это поминки. И добрая половина процессов в компании тоже

Однажды я зашёл в компанию через неделю после крупного падения и попросил показать постмортем. Мне показали — с гордостью. Таймлайн поминутно, five…

постмортемнадежностьreliabilityинцидентыуправление разработкойинженерная культураретроспективатехнический долгуправление командой
Хабр — Управление
RU

Rust: зачем он появился, что умеет и почему компании переписывают на него части своих систем

Эта статья — для тех, кто только присматривается к Rust или слышал о нем лишь обрывки восторженных или невосторженных отзывов. Если вы не до конца п…

rustjavagoc++webassemblyвысоконагруженные системынадежностьбезопасность