RU

Веб‑камера «увидела» глубину: как DepthART и WebGPU делают виртуальный свет в реальном времени

В сети разошлось короткое демо разработчика Конрада Речко. На первый взгляд ничего сверхъестественного: кадр с обычной веб‑камеры, по…

WebGPUTypeGPUDepthARTmonocular depth estimationоценка глубиныкомпьютерное зрениеGPUнейросети в браузеревиртуальное освещениеdepth estimation
Habr
RU

[Перевод] Как найти остров по одной фотографии: геолокация через геометрию и CUDA

Фото островного курорта. Ни EXIF, ни GPS, ни модели камеры – ничего. Нужно назвать курорт, координаты и сторону света, куда смотрела камера. Пытатьс…

OSINTгеолокацияCUDAGPUPythonгеометрияOpenStreetMapспутниковые снимкиNDVISentinel-2
Habr
RU

Корпоративный мозг на одной видеокарте: что на самом деле умеет локальная модель

Есть компании, где вопрос «какую модель выбрать» отходит на второй план, а первым встаёт другой: выйдут ли данные за периметр . Банк, госкорпорация,…

LLMЯзыковые моделиGPUВидеокартаRTX 3090ОркестраторИИИскусственный интеллектагенты ииai
Habr
RU

ИИ‑прогноз погоды на своём железе: запускаем AIFS 2.0 от ECMWF

Открытые веса модели мало помогают, если для её запуска нужен конкретный GPU и непростое окружение. Разберём, как запустить AIFS Single 2.0 от ECMWF…

AIFS 2.0ECMWFпрогнозирование погодымашинное обучениенейросетиинференсHugging Faceлокальный запускGPUвременные ряды
Habr
RU

NVIDIA RTX PRO 5000 Blackwell с 72 Гб видеопамяти. Есть ли смысл переплачивать за «половинку» флагмана?

RTX PRO 5000 Blackwell на 72 Гб: золотая середина для локальных ИИ-моделей или переоцененный апгрейд? Разбираемся в нашем обзоре. Читать далее

NVIDIABlackwellRTX PRO 5000GPUVRAMLLMинференсDeepSeekCUDAhostkey
Habr
RU

Т9 за сотню долларов, ассистент за миллиард: сколько на самом деле стоит обучить LLM с нуля

«Лучший ChatGPT за $100», «китайцы обучили GPT-4 за шесть миллионов», «модель с нуля на одной игровой карте за вечер» — за последний год такие загол…

LLMобучение LLMpretrainingмашинное обучениенейросетиGPURTX 5090H100стоимость обучения моделейnanochat
Habr
RU

Перенёс ByteTrack на GPU и ускорил мульти-камерный трекинг в 6 раз

GPU-версия ByteTrack, где математика всех камер считается общими батчами: один вызов на все потоки вместо трекера-на-камеру. На 16 потоках это ускор…

ByteTrackтрекинг объектовmulti-object trackingGPUPyTorchReIDкомпьютерное зрениеоптимизация производительностиCUDAвидеоаналитика
Habr
RU

Конвертируем цвета в JS со скоростью 6 миллиардов операций в секунду

В начале этого года я создал самую быструю JS-библиотеку для работы с цветом: парсинг различных форматов, конвертация в OKLAB/OKLCH, проверка попада…

JavaScriptWebGLGPUфрагментные шейдерыGLSLOKLCHпроизводительностьоптимизацияcanvascolordx
Habr
RU

Полез в исходники vLLM, чтобы понять, почему один символ убивает prompt caching

В первой части я вывел одно правило и предложил жить по нему: стабильное в начало, изменчивое в хвост , один символ в системном промпте обнуляет вес…

prompt cachingKV-cacheprefix cachingPagedAttentionvLLMLLMинференс LLMGPUprefillоптимизация
Habr
RU

Как нарисовать тысячи объектов на карте и не убить FPS: эволюция рендера на Mapbox GL

Когда-то давно я разрабатывал геолокационную соцсеть, где на карте живут «облака» — посты, привязанные к точке. И этих облаков на экране могло быть…

iOSSwiftMapboxкартырендерингпроизводительностьоптимизацияGPUFPSdata-driven
Habr
RU

Cloud.ru запустила Evolution Stack.ML для обучения ИИ-моделей в гибридном облаке

Cloud.ru вывела в коммерческую эксплуатацию платформу Evolution Stack.ML для обучения ИИ-моделей. Для кого решение и какие цифры приводит компания.…

Машинное обучениеОблачные технологииИнновацииКибербезопасностьGPUИнфраструктураНовости
Tproger
RU

Живой космос на Metal: как я переписывал фон мобильной игры и поднимал FPS с 20 до 120

В мобильной разработке мы привыкли, что красивый анимированный фон — это либо видео, либо пара слоёв с CAGradientLayer и медленным параллаксом. Для…

Metalшейдерыоптимизация производительностиiOSSwiftSpriteKitGPUMTKViewfragment shaderмобильная графика
Habr
RU

Продали дом за 7 000 000₽ и потеряли в майнинге. Видеокарты остались — из них вырос сервис генерации

Начну с того, в чём стыдно признаваться. В конце 2021 года мы продали дом в Краснодаре за 7 млн. рублей и почти полови…

майнингвидеокартыGPUкриптовалютастартапнейросетьгенерация изображенийИИопытпровал
Habr
RU

Кто ворует ваш GPU: атаки на открытые LLM-эндпоинты (Ollama, llama.cpp) — и при чём тут кража облачных ключей

Коротко тезис: открытый Ollama — это бесплатный GPU для атакующего , и охота за таким compute давно поставлена на поток. Но за май наша сеть ханипот…

LLMOllamallama.cpphoneypotSSRFIMDSинформационная безопасностьGPUn8n
Habr
RU

Кремниевый король: Как NVIDIA заложила фундамент нейросетевой революции

Как компания, чьи чипы изначально предназначались для отрисовки полигонов в видеоиграх, стала главным бенефициаром ИИ-революции и пробила потолок ка…

NVIDIACUDAGPUмашинное обучениеистория ITархитектура процессоровДженсен Хуанг.
Habr
RU

«Серебряной пули не существует»: как RWB строит промышленный ИИ

Как Wildberries экономит миллионы с помощью ИИ: реальные кейсы, работающие решения и открытые инсайты от RWB, Avito, VK и Сбера. — Читать дальше « «…

Искусственный интеллектGPUИнфраструктураЖелезоСтатьи
Tproger
RU

Калькулятор VRAM для локальных LLM: Какие модели ИИ запустятся у вас на компьютере?

Когда я начал ковыряться с локальными LLM, главная боль была не в установке моделей, а в понимании, что вообще влезет в моё железо. Документация Hug…

LLMVRAMllama.cppлокальные моделиквантованиеKV cacheGQAбенчмаркGPU
Habr
RU

От GPU к платформе: как Selectel строит AI-инфраструктуру для бизнеса

Selectel анонсировал новый AI-сервер и публичный каталог LLM на конференции «MLечный путь». Разбираемся, как сбалансированная инфраструктура и партн…

КонференцииИскусственный интеллектDevOpsОблачные технологииАналитикаGPUСтатьи
Tproger
RU

Мы уткнулись в потолок. Почему видеокарты перестали быстро расти — и что с этим делать

H100 стоит $30 000 и потребляет 700 Вт. RTX 5090 — $2 000 (де-факто больше) и 575 Вт. Прирост производительности между поколениями сжался с 80% до 1…

GPUNVIDIAзакон МураHBMAI инфраструктурачиплетыархитектура GPULLMH100Blackwell
Habr
RU

Сравнение гибридных языковых моделей класса 9B для промышленного инференса

В материале сравниваются три открытые гибридные модели класса 9B (NVIDIA Nemotron‑Nano‑9B‑v2, Bamba‑9B‑v2, Qwen3.5‑9B) с референсной плотной Llama 3…

ПроизводительностьРаботаБотыIBMNVIDIAМаркетингQAАналитикааналитикGPUСтатьи
Tproger
RU

DLSS 5 — не провал. Будущее рендеринга: глубокий технический взгляд на новые подходы после 15-ти лет в геймдеве

Сегодня мы с вами погрузимся в технические дебри революции графического рендеринга. Проследим историю его развития, и конечно, заглянем в ближайшее…

Разработка игрИскусственный интеллектКомпьютерная графикаNVIDIA3D-технологииИнновацииGPUТехникаСтатьи