Как фундаментальная математика помогает переосмыслить градиентный спуск
Градиентный спуск — стандартный инструмент обучения нейросетей. Но с точки зрения линейной алгебры операция обновления весов выглядит некорректно: м…
Tech news from the best sources
Градиентный спуск — стандартный инструмент обучения нейросетей. Но с точки зрения линейной алгебры операция обновления весов выглядит некорректно: м…
Новые инструменты появляются быстрее, чем успеваешь их изучать: LLM, инфраструктура, фреймворки, подходы к разработке. Как выбрать то…
Чем отличаются DQN, PPO, SAC, AlphaZero и другие модели reinforcement learning друг от друга? В этой статье я простым языком разберу основные алгори…
Защита языковой модели отличается от защиты обычного веб-приложения одной принципиальной особенностью: пользовательский ввод для LLM — это не только…
При LoRA‑дообучении адаптеры обычно применяются ко всем слоям модели, хотя активность разных слоев во время обработки промпта заметно разл…
В начале 1780-х состоятельные парижане отправляли свое белье стираться через Атлантику на Гаити. Дело в том, что, помимо высокой стоимости локальных…
Я не пытался создать «нейросеть, которая всё понимает». Вместо этого я построил конвейер: компьютерное зрение для поиска видов, детерминир…
Привет, Хабр! Меня зовут Писарев Андрей, я руковожу отделом машинного обучения в департаменте технологий искусственного интеллекта. Мы с командой ра…
Python давно стал почти стандартным инструментом для машинного обучения, анализа данных и научных задач. Однако в вычислительно сложных проектах его…
На DS/ML‑собеседовании можно уверенно пройти теорию и всё равно получить отказ. Часто решение принимается позже — когда становится видно,…
Привет, Хабр! Я, Катрушенко Максим, занимаюсь внедрением ИИ в Первой Грузовой компании — крупном железнодорожном операторе на ры…
1000 сайтов в час вместо нескольких часов на каждый — так работает ЮScan, сервис автоматизированного аудита от ЮMoney. Его основная задача — помочь…
Всем привет! Меня зовут Заруцкий Семён, я выпускник и новоприбывший аспирант физического факультета МГУ. Изначально я занимался экспериментальными к…
Насколько точно можно определять местоположение людей с помощью Wi-Fi? А что если дополнить это BIM-данными и инфой об использовании помещений? Расс…
Современные AI-агенты действуют в реальном мире с помощью доступных им инструментов (tools). Ядро вокруг модели (LLM), которое позволяет всему этому…
Если вы замеряете прогресс своего солвера на случайной подвыборке из train, вы замеряете его не на том наборе. Медианная задача train занимает 100 к…
Привет! Меня зовут Саша Журавлев. Я венчурный инвестор и основатель фонда Mento VC. Мы инвестируем в технологические компании на стадиях Seed / Seri…
Самое опасное в больших языковых моделях — то, насколько легко с ними можно что-нибудь сделать. Вернее, даже не так: прототип продукта с LLM сделать…
Привет, Хабр! 17 сентября 2026 года в Москве и онлайн пройдет AI R&D DAY . Это конференция для исследователей, ML‑инженеров,…
Когда нужно прокачать конкретный навык, проще всего начать с практической задачи. В этом дайджесте собрали 39 открытых уроков августа для IT-специал…
Открытые веса модели мало помогают, если для её запуска нужен конкретный GPU и непростое окружение. Разберём, как запустить AIFS Single 2.0 от ECMWF…
Битва уже идёт, даже если ты этого не замечаешь. Более того, AI уже побеждает! Старые фильмы про битву против искусственного интеллекта, обычно, рис…
Можно ли повысить точность определения положения людей в помещении, опираясь только на инфраструктуру Wi-Fi, если дополнить её BIM-данными и семанти…
AI-агенты - это цикл обмена сообщениями между пользователем и языковой моделью (LLM), где для ответа пользователю модель может обратиться к доступны…
Представьте переговорную, где одновременно говорят несколько человек, а системе нужно понять, когда говорит целевой спикер, и выделить именно его го…
Всем привет! Меня зовут Алина Бабенко , я acting DS-менеджер в Авито . Наша команда занимается моделями монетизации в поиске и рекоменда…
Есть белок — рестриктаза ЭкоРИ. Она плавает в клетке, натыкается на двойную спираль ДНК и ищет конкретную последовательность из …
Порог 0,8 часто воспринимают как 80% уверенности — и на этом строят автоматизацию. Разберём, почему predict_proba может врать, как&nb…
В этой части мы проверим, есть ли у SME учебная дорога, сравнимая с той, которую получили тензорные ядра GPU; затем разберём два реально полезных ис…
Открывая онлайн-кинотеатр, сервис для прослушивания аудиокниг или музыки, пользователи редко задумывается о том, почему перед ним оказались именно э…