ICML 2026: большая конференция глазами исследователя генеративных моделей
Привет, Хабр! Меня зовут Арсений Иванов, в AIRI в команде «Вычислительный интеллект» я занимаюсь генеративными моделями на основе диффузио…
Tech news from the best sources
Привет, Хабр! Меня зовут Арсений Иванов, в AIRI в команде «Вычислительный интеллект» я занимаюсь генеративными моделями на основе диффузио…
Что ж, продолжим погружаться в теорию нейросетевой обработки фотографий. В первой части мы разобрали общий принцип работы диффузионных нейросетей и…
Двадцать лет назад убрать мусорный бак из кадра — это была целая история, требующая виртуозно владеть фотошопом. Чем дальше шло развитие «умных» инс…
Experts explain how they work, what they can do, and what's still unsettled.
Diffusion text models — which draft an entire block of text at once and then iteratively refine it, rather than generating one token at a time left…
TL;DR HiDream-O1-Image is one of the strongest open-weight text-to-image models out right now (it debuted around #8 in the Artificial Analysis T2I A…
TL;DR HiDream-O1-Image 8B Full raw outputs collapse on plain Japanese prompts — both instruction-following and aesthetics fail at once Tried to swap…
A few months ago we set ourselves a deceptively simple goal: produce coherent, high-quality video longer than 15 seconds, on a single GPU, in well u…