Nvidia’s AI advantage is moving beyond the GPU
The new generation of data center systems is increasing efficiency with smarter traffic control instead of just more processor cycles.
Tech news from the best sources
The new generation of data center systems is increasing efficiency with smarter traffic control instead of just more processor cycles.
Сравнили 5 GPU-платформ для запуска открытых LLM в России: immers.cloud, Cloud4Y, VK Cloud, HOSTKEY и AdminVPS. Разбираем конфигурации, цены и удобс…
В сети разошлось короткое демо разработчика Конрада Речко. На первый взгляд ничего сверхъестественного: кадр с обычной веб‑камеры, по…
Фото островного курорта. Ни EXIF, ни GPS, ни модели камеры – ничего. Нужно назвать курорт, координаты и сторону света, куда смотрела камера. Пытатьс…
Есть компании, где вопрос «какую модель выбрать» отходит на второй план, а первым встаёт другой: выйдут ли данные за периметр . Банк, госкорпорация,…
The AI buildout shows no signs of slowing. And with hundreds of billions of dollars a year going into data centers and GPUs, com…
Jordan Nanos discusses how semiconductor constraints, data center expansion, and networking bottlenecks impact AI software architecture. Drawing fro…
Открытые веса модели мало помогают, если для её запуска нужен конкретный GPU и непростое окружение. Разберём, как запустить AIFS Single 2.0 от ECMWF…
RTX PRO 5000 Blackwell на 72 Гб: золотая середина для локальных ИИ-моделей или переоцененный апгрейд? Разбираемся в нашем обзоре. Читать далее
«Лучший ChatGPT за $100», «китайцы обучили GPT-4 за шесть миллионов», «модель с нуля на одной игровой карте за вечер» — за последний год такие загол…
GPU-версия ByteTrack, где математика всех камер считается общими батчами: один вызов на все потоки вместо трекера-на-камеру. На 16 потоках это ускор…
В начале этого года я создал самую быструю JS-библиотеку для работы с цветом: парсинг различных форматов, конвертация в OKLAB/OKLCH, проверка попада…
Bryan Oliver discusses the frontier of AI infrastructure: chaos engineering for large-scale GPU clusters. He shares how engineering leaders can hand…
В первой части я вывел одно правило и предложил жить по нему: стабильное в начало, изменчивое в хвост , один символ в системном промпте обнуляет вес…
Когда-то давно я разрабатывал геолокационную соцсеть, где на карте живут «облака» — посты, привязанные к точке. И этих облаков на экране могло быть…
Cloud.ru вывела в коммерческую эксплуатацию платформу Evolution Stack.ML для обучения ИИ-моделей. Для кого решение и какие цифры приводит компания.…
В мобильной разработке мы привыкли, что красивый анимированный фон — это либо видео, либо пара слоёв с CAGradientLayer и медленным параллаксом. Для…
Начну с того, в чём стыдно признаваться. В конце 2021 года мы продали дом в Краснодаре за 7 млн. рублей и почти полови…
Сейчас я учусь на 2 курсе магистратуры МИФИ по ML ( это моё второе высшее образование, по 1 специальности я психолог и TechHR с опытом 17+ лет), и п…
Коротко тезис: открытый Ollama — это бесплатный GPU для атакующего , и охота за таким compute давно поставлена на поток. Но за май наша сеть ханипот…
NVIDIA анонсировала RTX Spark с 128 ГБ памяти и 1 петафлопсом FP4. Разбираем, чем суперчип грозит Apple Silicon и когда ждать первые ноутбуки на рын…
Как компания, чьи чипы изначально предназначались для отрисовки полигонов в видеоиграх, стала главным бенефициаром ИИ-революции и пробила потолок ка…
Как Wildberries экономит миллионы с помощью ИИ: реальные кейсы, работающие решения и открытые инсайты от RWB, Avito, VK и Сбера. — Читать дальше « «…
Nvidia says the Control Panel's features have been migrated to the Nvidia app.
Joseph Stein discusses engineering an enterprise AI-as-a-Service platform within a private cloud data center. He explains how to maximize underutili…
Разбираем облачные сервисы с GPU на 2026 год. Сравнение инфраструктуры, доступные видеокарты (от T4 до H200) и реальные цены на инстансы для ML и ин…
Ваш AI‑чат или автокомплит тормозит при 50 запросах в секунду? Монолит убивает GPU и латенси? В этом туториале — реальная а…
Когда я начал ковыряться с локальными LLM, главная боль была не в установке моделей, а в понимании, что вообще влезет в моё железо. Документация Hug…
The plan aims to speed up AI compute deployment while compensating residents.
Selectel анонсировал новый AI-сервер и публичный каталог LLM на конференции «MLечный путь». Разбираемся, как сбалансированная инфраструктура и партн…