RU

Найти человека по голосу среди 134 тысяч записей

В последний вечер дататона у нас оставалось три попытки отправить решение. К этому моменту мы уже перебрали несколько моделей, собрали тяжёлый ансам…

ииspeakerspeaker retrievalхакатонбизнес кейсmachinelearningансамбль моделейпоиск
Habr
RU

Как искать живой спрос в шумных городских Telegram-чатах

Городские Telegram-чаты похожи на непрерывный поток логов без схемы. В одном сообщении человек ищет квартиру, в следующем агент публикует двадцатую…

TelegramпоискembeddingspgvectorNLPуведомленияклассификация намерений
Habr
RU

Честный RAG eval set: как собрать первые 100-300 кейсов и не обмануть себя цифрой

В прошлой статье серии мы сжимали эмбеддинги и замеряли, насколько изменится выдача относительно полного fp32-поиска. Там это был правильный вопрос:…

ragretrievalevalsоценка качестваLLMэмбеддингипоискMTEBragasBEIR
Habr
RU

Как оценить стоимость ручного поиска документов в компании на 200 человек

В корпоративных системах обычно хорошо считают то, что приходит отдельным счётом: лицензии, серверы, внедрение, поддержку, подрядчиков. Эти расходы…

документыпоископтимизацияверсииИИденьгидокументооборот
Habr
RU

Как мы ускорили разметку видеопоиска в десятки раз и не потеряли качество: опыт внедрения VLM-асессора

Современный поиск по видеоконтенту — это высоконагруженная система, требующая молниеносной реакции и безупречной релевантности. Сервис VK Видео опер…

aivkпоискпоиск видеовидеоконтентvk видеоvlmвидеопоиск
Habr
RU

Как нейроответ Яндекса выбирает источники: прогнал 60 запросов через Search API и посчитал, что как

Наш любимый доходяга Яндекс частенько показывает вверху выдачи готовый ответ и ссылается в нём на три‑четыре сайта. При этом по …

иипоискяндексалисавыдачавыдача поисковиковискусственный интеллект
Habr
RU

Поиск IT-железа по 30+ дистрибьюторам сразу: как мы собрали 114k SKU

Кейс, в котором мы поняли что закупщику не нужен «ещё один маркетплейс» — нужен инструмент, который за один запрос покажет, у кого из дистров есть н…

B2BзакупкидистрибуцияпоискSaaSпарсингнормализация данныхIT-инфраструктураREST APIкейс
Habr
RU

Мечтали ли шумеры о нейросетях — от «живых поисковиков» до вездесущего ИИ

В наши дни поиск информации стал почти скучен и почти тривиален. На 90% запросов и вовсе можно получить ответ от встроенной в поисковик нейросети, б…

поисковые системынейросетииндексацияпоискданныехранениехранение данных
Habr
RU

Как мы ускорили расчёт факторов ранжирования в поиске Ozon с помощью динамической компиляции

Всем привет! Меня зовут Петя Портнов, я работаю в Ozon ведущим разработчиком в команде среднего поиска — слоя, который ранжирует поисковую выда…

javaпоископтимизация производительностикомпиляциябайткодjvmozon tech
Habr
RU

Хакатон Samsung IT Academy Hack 2026: как студенты оптимизировали поиск в корпоративном мессенджере

Поиск — штука настолько привычная, что её редко рассматривают как отдельную инженерную задачу. На деле это связка из четырёх частей: парсинг и норма…

хакатонпоискинформационный поискelasticsearchqdrantembeddingsвекторный поискранжированиеvk workspacevk tech
Habr