RU

Как повысить отказоустойчивость сервисов в кластере виртуализации с помощью оптимизации их распределения

Всем привет! Это первая публикация из цикла статей про распределение сервисов в кластере виртуализации. В статье будет описан один из подходов к решен…

инфраструктуравиртуализациякластерсервисынадёжностьотказоустойчивостьоптимизациявиртуальные машиныбалансировка нагрузкиметрики качества
Habr
RU

65 бесплатных уроков июля: от LLM и RAG до Kubernetes, Go и QA

Профессиональный рост часто упирается в конкретные слепые зоны: где демо AI-агента расходится с продакшеном, как выбирать платформу для AI-ворклоадов,…

LLMragkubernetesGoтестированиеархитектураинфраструктураподорка вебинаровбесплатные урокипрофессиональное развитие
Habr
RU

«Взрыв поверхности» или «вертикальный срез»: какой подход выбрать при построении MLOps-платформы?

Привет, Хабр! Меня зовут Кирилл Кулаков, я занимаюсь развитием MLOps-платформы в Uzum Fintech. Недавно у нас в команде разгорелся спор о том, как прав…

mlopsmlops-платформаинфраструктурапостроение инфраструктурыMLмашинное обучение
Habr
RU

Как мы валидировали сервер YADRO для NVIDIA H100 PCIe

Недавно на рынке появились PCIe-карты NVIDIA H100: они позиционируются как решения на базе SXM-чипов, извлеченных из HGX-модулей. Но точно ли их произ…

серверgpuискусственный интеллектвидеокартыинфраструктурабенчмаркипроизводительностьnvidiaпроцессоры
Habr
RU

Пик продаж как стресс-тест для ИТ-инфраструктуры или почему интернет-магазины не выдерживают сезонную нагрузку

По данным исследования, 69% интернет-магазинов в периоды высокого трафика сталкиваются со снижением скорости работы сайта, 38% — со сбоями отдельных ф…

slaтехническая поддержкасистемное администрированиеdevopsddos-атакамониторинг серверазащита от ddosчерная пятницаинфраструктураалерты