RU

Конец жирной маржинальности ИИ: всё о ценообразовании и дешёвых стоимостях моделей

В последнее время ИИ-сфера не просто падает, а даже входит в активную стадию конкурентности между несколькими фронтами — корпоративные ИИ (OpenAI и…

qwenz.aiglmox alphachatgptnvidiadeepseeknpuhugging face
Habr
RU

[Перевод] Рискованный бизнес Nvidia

Джей Кук, который прославился как американский герой за свою роль в обеспечении финансирования Союзных сил в Гражданской войне, 1 января 1870 года п…

ruvds_переводискусственный интеллектnvidiaинвестиции в иистартапыгиперскейлерыбудущее ии
Habr
RU

Разбор AMD EPYC Venice: 256 ядер, 2-нм TSMC, два сокета и СЖО как неизбежность

Всем привет, с вами Сергей Ковалёв, менеджер выделенных серверов в Selectel . Как инфраструктурный провайдер, мы ежедневно предоставляем клиентам се…

selectelit-инфраструктураcpuamdveniceamd epycintelnvidiaaiсерверы
Habr
RU

Ускорение инференса энкодерной guard‑модели: TensorRT, Triton, vLLM, Ray Serve

Когда в системе есть узел между LLM и пользователем его скорость также важна, как и скорость самой LLM. Когда этот узел сам является модел…

gliner2gliner guardguardrailstensorrtvllmnvidiaинференс нейросетейtriton-inference-server
Habr
RU

Как DLSS 5 меняет саму идею графики реального времени (и снова делает ПК-гейминг элитарным)

После скандального мартовского анонса Nvidia получила много негативных отзывов. Саму идею нейронного рендеринга не раскритиковал только ленивый, а п…

dlss 5dlssnvidia3d-графикаигровая графикаграфика реального времениразработка игр
Habr
RU

Подводные камни ИИ-инфраструктуры: что узнаёт заказчик через полгода после запуска (и как мы предусмотрели это в ПАК)

Привет, Хабр! Меня зовут Алексей, я архитектор в команде Скала^р (входим в Группу Rubytech). Мы разрабатываем программно-аппаратные комплексы (ПАК)…

gpullmrdmaинференсии-инфраструктурапрограммно-аппаратный комплекссамосборcudanvidiapytorch
Habr
RU

Anthropic остался один. За четыре дня Хуанг собрал 75 подписей и целый альянс

Дарио Амодеи ответил постом в блоге: бан открытых моделей не нужен, нужны три другие меры. Но каждая из них бьёт по NVIDIA.…

nvidiaanthropicдарио амодеидженсен хуангopen sourceКитайkimi k3Frontier AI Standards Bodyдемис хассабисOpen Secure AI Alliance
Habr
RU

Коалиция Хуанга удвоилась за сутки. Из фронтирных лаб её не подписала только Anthropic

Главное пополнение — Google и поддержка от Пичаи и Хассабиса. Amazon молчит, а за Anthropic в твиттере отдувается один технарь. Читать далее

дженсен хуангnvidiaopen sourceискусственный интеллектандрей карпатыйopenaianthropicдарио амодеисундар пичаиgoogle
Habr
RU

Дженсен Хуанг завёл твиттер и первым же постом собрал коалицию против фронтирных лаб

Его открытое обращение в защиту опенсорса подписали уже 35 компаний. Anthropic, Google и Amazon в списке нет. Читать далее

дженсен хуангnvidiaopen sorceискусственный интеллектмайкл крациосдэвид саксилон масксатья наделласэм альтманмарк цукерберг
Habr
RU

Как превратить домашний сервер в игровой стриминг на любое устройство в доме

Мой игровой ПК с 5800×3D переехал в шкаф в прихожей и стал домашним сервером, а играю я теперь на телевизоре, Steam Deck и ноутб…

moonlightsunshineгеймингсервер домаwolfстриминг игрnvidia
Habr
RU

Нейро сети для самых маленьких. Часть первая (которая после нулевой). Удобство в прокрустовом ложе оптимизации

Это первая (после нулевой) статья из серии  Нейро сети для самых маленьких , в которой мы разбираем инфраструктуру для запуска нейронных сетей.…

rdmagpudirect rdmainfinibandtcpethernetzero copyrocenvlinknvidiagpu
Habr
RU

Пузырь ИИ лопнул? Бизнес отказывается от ChatGPT, а Microsoft пытается спасти положение софтом: ML-дайджест

В июне этот экономический тупик стал главным драйвером изменений в индустрии. Компании перестали гнаться за брендами вроде OpenAI и начали массово п…

aiminimaxglm 5.2kimi 2.7nvidiamicrosoftopenaimlsysискусственный интеллектselectel
Habr
RU

Эволюция вычислительных систем с применением кремниевой фотоники: преодоление межкомпонентного барьера

Развитие полупроводниковой индустрии подошло к критической точке, когда классические методы масштабирования транзисторов практически исчерпали свой…

чипыпроизводствотранзисторпроцессорыinteltsmcsamsungоптоволокноramnvidia
Habr
RU

Как мы валидировали сервер YADRO для NVIDIA H100 PCIe

Недавно на рынке появились PCIe-карты NVIDIA H100: они позиционируются как решения на базе SXM-чипов, извлеченных из HGX-модулей. Но точно ли их про…

серверgpuискусственный интеллектвидеокартыинфраструктурабенчмаркипроизводительностьnvidiaпроцессоры
Habr
RU

80% мирового HBM. Как Корея захватила рынок памяти для ИИ

Какой главный корейский продукт? Многие назовут автомобили, электронику и бытовую технику, сериалы, косметику или даже K-Pop. Но главный корейский п…

памятьчипыполупроводникиhbmdramискусственный интеллектюжная кореяsamsungsk hynixnvidia
Habr
RU

Чтение на выходные: «Мыслящие машины Дженсена Хуанга: История Nvidia и мировой ИИ-революции» Стивена Витта

В 1993 году три человека в кожанках и с распечатками бизнес-плана оккупировали задний столик закусочной Denny's в Сан-Хосе. Вокруг полицейские запол…

nvidiaхуангистория успехаистория itистория созданияистория стартаповвидеокартыдженсен хуангменеджментменеджмент продукта
Habr
RU

Новые серверы в облаке mClouds: обзор Dell R7725 с 64-х ядерными AMD EPYC 9555

В начале 2026   года мы добавили к облачной платформе серверы Dell R7725.  В основе — новейшие 64-х ядерные процессоры AMD EPYC …

серверыжелезооблачная платформаоблачная инфраструктураintelgpunvidianvme ssdpcie gen 5.0amd epyc
Habr
RU

Из чего состоит GPU-кластер: обзор серверов с L40S, A16 и AMD EPYC на платформе mClouds

Привет, Хабр! Мы облачный провайдер mClouds, и у нас работает GPU-платформа с видеокартами NVIDIA L40S , A16 и другими. Задействуется для задач AI-р…

серверцодnvidiagpuвидеокартыdellamd epycоблачный сервервиртуализацияработа с данными
Habr
RU

[Перевод] Дезагрегированный инференс LLM в Kubernetes: префилл, декодирование и планирование подов

С ростом сложности рабочих нагрузок инференса больших языковых моделей (LLM) единый монолитный процесс обслуживания упирается в свои пределы. У преф…

vk cloudllmkubernetesinferencegpunvidiaдезагрегированный инференсоркестрацияавтомасштабированиепланирование подов
Habr
RU

Экономия GPU-часов в 2,5 раза, уход ИИ в бэкенд и новые стандарты агентских систем: ML-дайджест

Пока инфо-бизнесмены продают очередные курсы по промпт-инжинирингу, в индустрии пересобирают саму архитектуру ИИ-систем. Главные вызовы сегодня…

selectelLLMaimlискусственный интеллектдайджестжелезо и софтnvidiaamdsambanova
Habr