RU

Как поддерживать большую базу знаний для RAG и обновлять ее в полуавтоматическом режиме

У большой базы знаний есть неприятное свойство. Она хорошо отвечает на вопросы, которые в нее уже положили, и никак не сообщает о вопросах, которых…

RAGбаза знанийLLMAI-агентысемантический поискдедупликацияhuman-in-the-loopподдержка пользователейуправление знаниямиRetrieval-Augmented Generation
Habr
RU

Винни-Пух в 768 измерениях: семантический поиск Codex Pets на YDB

В многомерном пространстве найти Винни-Пуха можно даже не зная его имени. В запросе “тревожный коричневый медведь из старого мультфильма” нет ни одн…

YDBсемантический поисквекторный поискэмбеддингиYandex AI StudioCodexCodex Petsрекомендательные системы
Habr
RU

SayFable: офлайн-библиотека с NLP-разметкой, синтезом на 68 языков и чатом по книге

Привет, Хабр! В прошлых статьях я рассказывал про  локальный переводчик с синтезом голоса на кабардинском  и про то,  как собрать пол…

NLPRAGсинтез речиsileroсемантический поискэмбеддингиswiftразработка под iosискусственный интеллектмалоресурсные языки
Habr
RU

Я научил Obsidian искать по смыслу. Как устроен локальный семантический индекс без отдельной векторной БД

В комментариях к прошлой статье мне написали примерно следующее: граф связей выглядит красиво, но хороший поиск по заметкам полезнее. Спорить было т…

Obsidianсемантический поискembeddingsвекторный поискTypeScriptлокальный индексLocalVectorStoreOpenRouterOllamaVault Audit AI
Habr
RU

Классический поиск умирает из-за ИИ – что делать и как с этим жить?

Всем привет! Меня зовут Олег Джулаев, я автор Projecto . Этот материал больше не о том, что классические блоги и инфосайты вымирают как класс, а о т…

искусственный интеллектaiпоисковые системыпоисковые алгоритмысемантический поисксайтыпродвижениепродвижение сайтов
Habr
RU

Внешний бенчмарк причинного recall: проверяем память ИИ-ассистента на YDB Яндекса

Коротко, о чём речь, — для тех, кто пришёл по слову «Яндекс» и предыстории не знает. Когда ИИ-ассистент помогает чинить баг, самое ценное — не сочин…

ИИ-агентыпамять агентаRAGбенчмаркrecallграфовая памятьэмбеддингисемантический поискYDBвоспроизводимость
Habr
RU

OpenClaw + NixOS: декларативный AI-ассистент с долгосрочной памятью

Настраиваем OpenClaw: Telegram-бот, GLM-4.7-flash, векторный поиск через QMD и управление секретами через agenix Читать далее

nixosopenclawai-ассистентсемантический поискдекларативная конфигурацияtelegram-ботglm-4.7-flashвекторный поискуправление секретамиинфраструктура
Habr
RU

Как я три года пилю свой музыкальный сервер: часть первая

Описываю настроение словами — и Raspberry Pi находит подходящие треки в моей коллекции, полностью локально, без облака и подписки. Как это устроено…

CLAPсемантический поискаудио-эмбеддингиONNX Runtimeмашинное обучениеRaspberry Piмузыкальный серверпоиск музыки по настроениюhi-fiopen source
Habr
RU

Как мы создавали «умный» поиск по регламенту вуза

Я преподаю на кафедре информационных технологий и больше двадцати лет пишу код. Однажды эти две роли сошлись в проекте, который я затеял для себя: н…

ragretrieval-augmented generationэмбеддингивекторный поисксемантический поискllmгибридный поискчат-ботmax мессенджерии-ассистент
Habr
RU

Как мы создали внутреннего ИИ-помощника на базе RAG и перестали искать ответы по корпоративной Wiki

Компании со временем накапливают тысячи страниц документации, и найти нужную информацию становится всё сложнее. Обычный поиск перестаёт справляться,…

ragllmкорпоративный поискai-ассистентвекторный поискopensearchfridamilvusискусственный интеллектсемантический поиск
Habr
RU

Manticore Search 27.1.5: аутентификация, шардированные таблицы, диалоговый поиск и более быстрый векторный поиск

Manticore Search 27.1.5  выпущен. Этот релиз приносит встроенные аутентификацию и авторизацию, шардированные таблицы, conversational search, бо…

полнотекстовый поисквекторный поискаутентификациясемантический поискsqlsharding
Habr
RU

Почему AI-агент ищет по коду неправильно, и как это чинит cocoindex-code за две команды

Если вы работаете с Claude Code или Cursor на большом проекте, знаете боль: просишь “найди, где обрабатывается авторизация”, а агент гоняет grep по…

Claude Codeсемантический поискэмбеддингиTree-sitterASTMCPcocoindexcode search
Habr
RU

Векторы по косинусу считают. Косинусное сходство, альтернативы, плюс — фановые проекты с эмбеддингами

Недавно мы в Beeline Cloud делали подборку руководств и обучающих материалов по теме эмбеддингов. Сегодня решили поговорить о распространенном подхо…

beeline cloudвекторный поисккосинусное расстояниесемантический поискэмбеддинги
Habr
RU

Эволюция 'More Like This'

Во многих поисковых сценариях пользователь начинает не с пустой строки запроса, а с существующего результата. Пользователь открывает статью и хочет…

nlpобработка естественного языкавекторный поископтимизация производительностиполнотекстовый поисксемантический поискранжирование поискаtf-idfbm25
Habr
RU

Раннее завершение KNN-поиска в Manticore Search

Современные поисковые системы уже не просто сопоставляют ключевые слова. Когда вы ищете «уютный детектив, действие которого происходит в Париже», а…

knnknn-searchвекторный поисксемантический поискhnswembeddingsoversamplingполнотекстовый поиск
Habr
RU

Obsidian Hybrid Search (OHS). MCP и CLI, которые выводят поиск по заметкам с AI-агентами на новый уровень

AI-агенты умеют искать по Obsidian-хранилищу, но делают это слишком топорно через glob и grep. Да, для кода эти инструменты работают потрясающе, но…

ObsidianObsidian Hybrid SearchMCPAI-агентыгибридный поисксемантический поискBM25RRFбаза знанийPKM
Habr
RU

Защита от дублирования кода агентами: семантические концепции

Я строю Telegram-first SaaS в одиночку, а весь код за меня пишут ИИ-агенты Claude Code, и довольно быстро я уперся в неприятное: каждый новый агент…

ИИ-агентыClaude Codeдедупликация кодаграф концептовэмбеддингисемантический поискType-4 клоныretrievalDRYпамять агентов
Habr
RU

Некорпоративный Хабр: семантический поиск и фильтрация по структурированным полям

Классический RAG индексирует исходный текст документа, предварительно разбивая на фрагменты. Потом рассчитывает векторное представление фрагментов и…

семантический поискструктурирование инфомациилокальный поиск по документамэмбеддингиduckdb wasmwllamallm-приложенияsqlragllm
Habr
RU

«Эмбеддинги на примерах с собаками», или как работать с векторными представлениями: книги и руководства по теме

Мы в Beeline Cloud собрали для вас подборку открытых руководств и обучающих материалов по теме эмбеддингов: что собой представляют подходы TF-IDF и…

beeline cloudэмбеддингивекторные представлениясемантический анализсемантический поиск
Habr
RU

[Перевод] Как мы перешли на Opus и стали платить меньше

На прошлой неделе мы писали о том, как  скармливали терабайты CI-логов LLM . Большинство вопросов на Hacker News касались не самих логов — спра…

LLM-агентыmulti-agentClaude OpusClaude HaikuоркестраторtriagerClickHouseсемантический поискстоимость инференса