RU

Локальный запуск LLM для SOC: сколько инцидентов обработает одна GPU? Часть 2

Всем привет! На связи Сергей Иванов, аналитик технологий машинного обучения R‑Vision. В первой части эксперимента мы выяснили, как на п…

llmsocgpuавтоматизация SOCnvidia rtx pro 6000 blackwellvllmqwen3.5AI в SOCинференс llmself-hosted llm
Habr
RU

DSpark на двух DGX Spark: порт, баг на одну строку и бенчмарки, которые пришлось мерить заново

DeepSeek выпустил DSpark — спекулятивный декодер для V4. В окне 27–30 июня 2026 рабочего публичного пути для GB10 н…

dgx sparkdeepseekvllmспекулятивный декодингspeculative decodingdsparkllm-инференсбенчмаркиnvfp4nvfp8
Habr
RU

DGX Spark на 256K контексте: тестирую конфигурации vLLM, реальные замеры и почему NVFP4 в mainline сломан

NVIDIA продаёт спарку с лозунгом «один петафлоп на FP4». Я купил коробку, поставил vLLM, запустил инференс и получил 40 токенов в …

vllmdgx sparkgb10blackwellnvfp4llmинференслокальный ии