Что теперь нужно знать современному LLM-инженеру
Все мы иногда меняем работу. Я вот тоже недавно решил. Походил по собеседованиям и удивился. Спрашивать стали больше, шире, детальнее. Кажется, что…
Tech news from the best sources
Все мы иногда меняем работу. Я вот тоже недавно решил. Походил по собеседованиям и удивился. Спрашивать стали больше, шире, детальнее. Кажется, что…
Привет, Хабр! Давайте на примере кейса с рекламой в ПВЗ Wildberries разберемся в двойном машинном обучении (DML) и методе псевдорандомизации (PSM).…
Привет, Хабр! Я, Катрушенко Максим, занимаюсь внедрением ИИ в Первой Грузовой компании — крупном железнодорожном операторе на ры…
Не обязательно поступать в Harvard, Stanford или MIT, чтобы учиться по материалам этих университетов. Собрала 10 платформ и университетских ресурсов…
Если вы занимаетесь ML / AI, Computer Science или научными исследованиями , диссертации могут быть очень полезным источником идей для research. 🔬 Ес…
Всем привет! Меня зовут Дмитрий Шипилов, с вами команда поиска Uzum Market. Мы уже рассказывали вам о нашем поисковом движке: о том, как вообщ…
Исторически в Яндекс Картинках релевантность документа оценивалась по двум сигналам: насколько запросу подходит само изображение и насколь…
Мы знаем его как "метод на основе Теории Игр", "фреймворк" и издалека чувствуем, что это он, видя красные и синие полоски. Но что сделало этот метод…
Краткий обзор курса, который я недавно закончил пилить на Степике - Геопространственный анализ данных на Python . Курс посвящен работе с векторными…
Продолжая тему Крошечной Языковой Модели на Nodejs мы поймем где проходит граница ее возможностей. На примере Крошечной Языковой Модели (TLM) из 2 1…
Мы создаем крошечную языковую модель с нуля на чистом Node.js без использования TensorFlow или PyTorch, реализуя нейроны, автоград, эмбеддинги, меха…
Введение Кажется, что нейросети могут все. Мы видим результат их работы в системах распознавания лиц, видеоаналитике. Нас поражает умение нейросетей…
Чтобы дать команду умной колонке, не обязательно говорить активационное слово «Алиса»: есть быстрые команды — короткие фразы, с …
Привет, Хабр. Меня зовут Тянчи Ю, я работаю младшим научным сотрудником в группе «Вычислительный интеллект» AIRI и учусь на четвёртом году…
Обучил multi-label классификатор на 15 классов для модерации Discord-сообщества, получил micro F1 = 0.9358 — цифра, с которой можно закрывать задачу…
У меня накопилось 23 Telegram-канала. Не потому что я специально их коллекционировал. Просто со временем подписывался на новые. В какой-то момент по…
Юнит-тесты, интеграционные и Playwright E2E ловят баги в интерфейсе, но бессильны против вопроса «а не выгоднее ли просто положить стартовый капитал…
В прошлой статье я сделал обзор на существующие на данный момент методы реализации анимации персонажей с применением машинного обучения. Однако суще…
В статье подробно рассматриваются принципы работы больших языковых моделей (large language model, LLM). Поскольку в основе большинства современных L…
Хорошая рекомендательная система быстро учится угадывать, что вы положите в корзину. И чем точнее она угадывает, тем реже показывает…
Самая вычислительно прожорливая индустрия в истории считает на языке, который медленнее C примерно в 70 раз и занял 26-е место из 27 по энергоэффект…
Всем привет, это моя первая статья на Хабре, и я решил посвятить ее своему недавнему мини‑проекту, сутью которого является обучение небольшого…
И снова здравствуйте! Продолжаю свой рассказ о поиске «универсального рецепта» для обучения моделей в Luna Line. Теперь речь пойдет о сегментации. Е…
Трансформеры уже умеют писать код, генерировать тексты и рисовать картины. Но могут ли они управлять автономным автомобилем в реальны…
В пайплайне перевода видео в Яндекс Браузере скорость работы в синтезе речи долго оставалась узким местом: одно видео — это сотн…
Семь месяцев назад я каждый день наблюдал, как BTC летит вверх, ETH разворачивается, SOL вроде зажимается в боковике. На каждой паре — свои таймфрей…
Retrieval-Augmented Generation (RAG) чаще всего рассматривается в контексте вопросно-ответных систем и чат-ботов поверх базы знаний. Большинство пуб…
Можно ли перенести LLM из кремния в чистую оптику? Чтобы проверить эту идею без дорогого лабораторного стенда, я собрал установку из обычного смартф…
Создать демо-версию RAG сегодня можно за 15 минут: LangChain, ChromaDB, API OpenAI — и бот отвечает на простые вопросы. Но когда этот прототип сталк…
Любой аналитик знает, что самым надёжным способом проверки гипотез являются рандомизированные контролируемые эксперименты (RCT), или, как их называю…