RU

Бесшовный переход в индустрию: как закрыть разрыв между вузом и реальным ИИ‑проектом

Привет, Хабр, я Анастасия Сапрыкина, работаю на стыке двух миров: академического и индустриального. Сейчас в России активно развивается прог…

образованиегосполитикастратегияискусственный интеллекткарьера в itmlopsии-агентыedtechстажерысайбокс
Habr
RU

От legacy до промышленной платформы: инженерная эволюция OSA в «Магнит»

Как мы провели проект через четыре «эпохи» — от ручных запусков на Windows‑планировщике до Spark + k8s на масштабе сети …

data engineerbigdatamlopsdata scienceosapysparkоблачные вычисленияархитектура системыdatalake
Habr
RU

[Перевод] Как оптимизировать LLM-инференс в 2026 году

Если вы в 2026 году запускаете LLM в продакшене, то почти наверняка больше всего денег тратите на инференс. Одна неоптимизированная модель размером 70…

оптимизация инференсаllm в продакшенеmlopsvllmkv cachepagedattentionprefix cachingквантованиеспекулятивный декодинг
Habr