RU

GigaChat 2 Max с памятью на связях обходит Claude Opus 5 без неё: замер семи моделей

На классе задач «в работе всплыла проблема — каким изменением её уже чинили»  GigaChat 2 Max с памятью на связях отвечает верно в 57% случаев,…

GigaChatYandexGPTClaudeLLMRAGвекторный поискэмбеддингиИИ-агентыпамять ИИ-агентаopus
Habr
RU

Как мы сделали бота-консультанта: нейросети и машинное обучение

Одно из важнейших направлений нашего бизнеса – разработка программ для автоматизации бизнес-процессов, управления и учёта предприятий и организаций.…

ииии-ассистентии чат-ботии помощникмашинное+обучениевекторный поиск
Habr
RU

От LLM-портала до фабрики внутренних агентов: как в Авито строят корпоративного ассистента «Виталик»

По данным McKinsey, к концу 2025 года 71% компаний пробовали интегрировать искусственный интеллект как минимум в один из бизнес-процессов. Звучит мо…

aillmagentautomationclaudemachine-learningai-агентыоркестрация агентоввекторный поискпромпт-инжиниринг
Habr
RU

Винни-Пух в 768 измерениях: семантический поиск Codex Pets на YDB

В многомерном пространстве найти Винни-Пуха можно даже не зная его имени. В запросе “тревожный коричневый медведь из старого мультфильма” нет ни одн…

YDBсемантический поисквекторный поискэмбеддингиYandex AI StudioCodexCodex Petsрекомендательные системы
Habr
RU

Я научил Obsidian искать по смыслу. Как устроен локальный семантический индекс без отдельной векторной БД

В комментариях к прошлой статье мне написали примерно следующее: граф связей выглядит красиво, но хороший поиск по заметкам полезнее. Спорить было т…

Obsidianсемантический поискembeddingsвекторный поискTypeScriptлокальный индексLocalVectorStoreOpenRouterOllamaVault Audit AI
Habr
RU

Эволюция поиска вакансий в Авито Работе: ML-оптимизации и инсайты из АБ-тестов

Привет! Меня зовут Вадим Вахрушев , я старший DS-инженер в  Авито , занимаюсь задачами поиска. В статье расскажу, как устроено р…

retrieval systemsmachine-learningранжированиерекомендательные системыCTRab-тестированиевекторный поискэмбеддинги
Habr
RU

Локальная RAG-система на Go, PostgreSQL и Ollama без облачных API

RAG уже стал стандартным способом научить LLM работать с собственными документами без дорогостоящего дообучения. Но за кажущейся простотой скрываетс…

RAGRetrieval-Augmented GenerationGogolangPostgreSQLOllamaэмбеддингивекторный поисклокальные моделиllm
Habr
RU

Manticore Search 28.4.4: быстрый рескоринг KNN, более гибкий диалоговый поиск, упрощённая установка и улучшенные фасеты

Мы выпустили  Manticore Search 28.4.4  . В этом релизе ресоринг KNN стал быстрее, диалоговый поиск — гибче, установка и обновление — проще…

knnknn-searchvector searchfacetsвекторный поискфасетный поискsqlрелизполнотекстовый поиск
Habr
RU

Как я настраивал OpenClaw на NixOS

Собираю воспроизводимого AI-ассистента, который помнит историю диалогов и разворачивается одной командой Читать далее

nixosopenclawglm-4.7-flashtelegram-ботвекторный поискдекларативная конфигурацияуправление секретамиgatewayai-ассистентинфраструктура
Habr
RU

Turbopuffer vs Manticore Search: бенчмарк на недорогих VPS

Векторные базы данных в serverless-модели обычно обещают простую вещь: не требуется развёртывание и настройка, а провайдер берёт на себя управление…

бенчмаркбенчмаркивекторный поисксравнение поисковых механизмовполнотекстовый поискlatencyvector searchзадержкагибридный поиск
Habr
RU

OpenClaw + NixOS: декларативный AI-ассистент с долгосрочной памятью

Настраиваем OpenClaw: Telegram-бот, GLM-4.7-flash, векторный поиск через QMD и управление секретами через agenix Читать далее

nixosopenclawai-ассистентсемантический поискдекларативная конфигурацияtelegram-ботglm-4.7-flashвекторный поискуправление секретамиинфраструктура
Habr
RU

Поймали ИИ-агента на вранье — его же памятью

На днях наш агент собрался дежурно отчитаться об успехе. Прежде чем нажать «готово», он сверился с собственной памятью — и нашёл там запись из прошл…

ИИ-агентыпамять агентаLLMRAGвекторный поискэмбеддингиграфовая памятьранжированиеMRRHippoRAG
Habr
RU

Как AI видит ваш сайт и почему Бизнесу надо это знать

TL;DR: RAG-поиск (Retrieval-Augmented Generation, генерация с подкреплением поиском) – это механизм, при котором AI сначала находит релевантные куск…

RAG-поискRetrieval-Augmented Generationгенеративный поискранжирование AIвекторный поискрелевантность контентаоптимизация под ИИ-поисковикииндексация сайтовалгоритмы LLM
Habr
RU

Метод, которого не существовало: как я собрал локальный RAG для CAD API

Последние годы инжиниринг живёт под одним лозунгом: то же самое, но дешевле и быстрее. Заказчики сокращают бюджеты и сроки, подрядчики ищут, какие п…

Smart3DCAD APIRAGLLMC#.NETгенерация кодавекторный поисклокальная языковая модельпромышленная автоматизация
Habr
RU

Чек-лист тестирования поисковой системы: от engine sanity до RAG и графов знаний

Чек-лист для тестирования поисковых и RAG-систем — от базовой работоспособности поискового движка до качества генерации, агентных сценариев и поведе…

поисковые системытестирование поискаllmragвекторный поискqa
Habr
RU

Как я писал in-memory векторный движок на Go — и в каком месте он обогнал hnswilb

Полгода назад я начал писать in-memory базу с векторным поиском на Go: RESP-протокол, HNSW-индекс, WAL, многопоточность. Рассказываю, что из этого в…

векторные базы данныхвекторный поискhnswgolanggoin-memorybenchmarkквантизацияrag
Habr
RU

DS MCP: как дать AI-агенту знание о вашей дизайн-системе

Статья про то, как AI-агенту дали знание о дизайн-системе, чтобы он перестал придумывать несуществующие компоненты и начал верстать из того, что реа…

mcpai-агентыдизайн-системаfigma mcpds mcpragchromadbгенерация версткивекторный поискfrontend
Habr
RU

Как мы создавали «умный» поиск по регламенту вуза

Я преподаю на кафедре информационных технологий и больше двадцати лет пишу код. Однажды эти две роли сошлись в проекте, который я затеял для себя: н…

ragretrieval-augmented generationэмбеддингивекторный поисксемантический поискllmгибридный поискчат-ботmax мессенджерии-ассистент
Habr
RU

Contextual Retrieval: техника, которая чинит главную проблему RAG за 50 центов на тысячу чанков

Классический RAG часто ошибается не из‑за слабой embedding‑модели, а потому что чанки теряют связь с исходным документом. Разбир…

RAGContextual RetrievalLLMembeddingsBM25rerankingчанкивекторный поискбаза знанийкорпоративный ИИ
Habr
RU

Как мы создали внутреннего ИИ-помощника на базе RAG и перестали искать ответы по корпоративной Wiki

Компании со временем накапливают тысячи страниц документации, и найти нужную информацию становится всё сложнее. Обычный поиск перестаёт справляться,…

ragllmкорпоративный поискai-ассистентвекторный поискopensearchfridamilvusискусственный интеллектсемантический поиск
Habr
RU

Как подключить таск-трекер к кодовой базе через RAG и не сойти с ума от стоимости токенов

Главная проблема работы с LLM в реальном проекте — не качество модели, а контекст. Рассказываю, как с помощью RAG-индекса репозитория (векторы + гра…

RAGLLMClaude Codeтаск-трекервекторный поискNeo4jMCPграф кода
Habr
RU

В 14 раз быстрее: как мы ускорили генерацию эмбеддингов в Manticore через ONNX

Когда мы выпустили  Auto Embeddings  — функцию автоматического преобразования текстов в векторные представления — без развёртывания отдель…

onnxonnx runtimeonnxruntimeembeddingsэмбеддингиинференсвекторный поискvector search
Habr
RU

Manticore Search 27.1.5: аутентификация, шардированные таблицы, диалоговый поиск и более быстрый векторный поиск

Manticore Search 27.1.5  выпущен. Этот релиз приносит встроенные аутентификацию и авторизацию, шардированные таблицы, conversational search, бо…

полнотекстовый поисквекторный поискаутентификациясемантический поискsqlsharding
Habr
RU

Как мы ускорили KNN-поиск в Manticore: двухпроходный обход HNSW, пакетная обработка и AVX-512

Кратко:  Три изменения в HNSW-поиске ускоряют KNN-поиск до 29% при больших k и дают более 20% прироста при параллельной нагрузке. Без изменений…

knnknn-searchобработка больших данныхобработка больших массивов данныхhnswvector searchвекторный поискperformanceperformance optimizationпроизводительность
Habr
RU

Векторы по косинусу считают. Косинусное сходство, альтернативы, плюс — фановые проекты с эмбеддингами

Недавно мы в Beeline Cloud делали подборку руководств и обучающих материалов по теме эмбеддингов. Сегодня решили поговорить о распространенном подхо…

beeline cloudвекторный поисккосинусное расстояниесемантический поискэмбеддинги
Habr