RU

От ANN к честному KNN на GPU: как мы пересобрали отбор кандидатов в рекомендациях Ozon

Привет! Мы команда рекомендательной системы Ozon, и сегодня мы хотим рассказать о нашем пути от приближённого поиска соседей (ANN) к точному KNN на GP…

annrecsysbigdataretrievalknnsparkpytorchgpuрекомендательные системыozon tech
Habr
RU

Локальный запуск LLM для SOC: сколько инцидентов обработает одна GPU? Часть 2

Всем привет! На связи Сергей Иванов, аналитик технологий машинного обучения R‑Vision. В первой части эксперимента мы выяснили, как на п…

llmsocgpuавтоматизация SOCnvidia rtx pro 6000 blackwellvllmqwen3.5AI в SOCинференс llmself-hosted llm
Habr
RU

Разворачиваем MiniMax-M2.7 на GPU-инфраструктуре с поддержкой S3

Использовать нейросети для работы с внутренними данными компании — идея классная, но скармливать их внешним API банально опасно. Никому не хочется, чт…

mlselectelit-компанииit-инфраструктураs3-хранилищеminimax m2.7gpuии
Habr
RU

Hermes + Qwen3.6-27B: как я собрал первую линию email-поддержки

Я решил в качестве эксперимента собрать первую линию email-поддержки вокруг локальной LLM — без файн-тюнинга и попыток сразу заменить всю службу подде…

hermesqwen3.6qwenhelpdeskagentоблачная инфраструктураgpuаренда gpurtx5090поддержка пользователей
Habr
RU

Всё, что вы хотели знать про локальные LLM, но боялись заинференсить

LLM может влезать в контекст и генерировать 200 tok/s, но если она не может найти нужный факт в тексте, толку от этого мало. Поэтому мы захостили 8 ло…

квантованиеllmбенчмаркиоблачная инфраструктураgpurtx 5090большие языковые модели
Habr
RU

Как мы валидировали сервер YADRO для NVIDIA H100 PCIe

Недавно на рынке появились PCIe-карты NVIDIA H100: они позиционируются как решения на базе SXM-чипов, извлеченных из HGX-модулей. Но точно ли их произ…

серверgpuискусственный интеллектвидеокартыинфраструктурабенчмаркипроизводительностьnvidiaпроцессоры
Habr
RU

Tensordyne Napier — еще одно решение на замену традиционных GPU в инференсе

Почти каждый месяц очередной стартап, производящий серверное железо, объявляет о своих ноу-хау. Естественно, ориентированных на задачи инференса и обу…

selectelit-компанииit-инфраструктураgpuинференсsram
Habr
RU

Новые серверы в облаке mClouds: обзор Dell R7725 с 64-х ядерными AMD EPYC 9555

В начале 2026   года мы добавили к облачной платформе серверы Dell R7725.  В основе — новейшие 64-х ядерные процессоры AMD EPYC 95…

серверыжелезооблачная платформаоблачная инфраструктураintelgpunvidianvme ssdpcie gen 5.0amd epyc
Habr
RU

Железный дайджест за май: тесты B300, GPU от Alibaba и PCIe 8.0

Изучаем самые интересные новинки серверного железа за май, делимся техническими деталями и оцениваем перспективы свежих решений. В фокусе внимания — р…

selectelit-компанииit-инфраструктуражелезо и технологиинакопителисерверыgpu
Habr
RU

Три фикса, четыре ошибки, один файл

# Как мы четыре раза неправильно диагностировали зависание на джобе 281 339 Несколько месяцев назад я писал, [как мы четыре раза неправильно чинили ме…

rustwgpugpuinstanced renderingоптимизация производительностирендерингcomputer graphicsedavulkan api
Habr
RU

Cколько железа нужно ИИ-агенту? Как мы считали ресурсы для on-premise LLM и почему калькуляторы ошиблись в 5 раз

На связи Сергей Смирнов, AI-инженер и основатель LLMStart.ru. Один из самых частых вопросов от бизнеса: «Сколько и какого железа нужно, чтобы разверну…

llmaigpuon-premiseagentperformancetpsttfttokens
Habr
RU

Как мы четыре раза неправильно чинили мерцание при рендеринге 4,4 миллиона полигонов на wgpu

Уже год мы небольшой командой пишем на Rust + wgpu редактор топологий интегральных схем — что-то вроде KLayout, только с прицелом на российский рынок.…

rustwgpugpuinstanced renderingоптимизация производительностирендерингcomputer graphicsedavulkan api
Habr
RU

Тестируем выделенный L40S и vGPU на 16 ГБ по производительности (llama.cpp, ComfyUI)

Сегодня в интернете какой только нет информации об искусственном интеллекте или его применении в разных сферах. Можно сказать, что он уже плотно вошел…

gpuvgpullmllama.cppнейросетиcomfyuivdsпроизводительностьтестированиеfirstvds
Habr