RU

Семантического поиска оказалось мало. Как я научил Obsidian находить похожие заметки

В прошлой статье я рассказывал, как добавил в Obsidian локальный семантический индекс. Сам проект развивается открыто, код лежит здесь: GitHub: http…

Obsidiansemantic searchembeddingsvector searchSimilar NotesTypeScriptcosine similarityvector indexsemantic discovery
Habr
RU

Как искать живой спрос в шумных городских Telegram-чатах

Городские Telegram-чаты похожи на непрерывный поток логов без схемы. В одном сообщении человек ищет квартиру, в следующем агент публикует двадцатую…

TelegramпоискembeddingspgvectorNLPуведомленияклассификация намерений
Habr
RU

Я научил Obsidian искать по смыслу. Как устроен локальный семантический индекс без отдельной векторной БД

В комментариях к прошлой статье мне написали примерно следующее: граф связей выглядит красиво, но хороший поиск по заметкам полезнее. Спорить было т…

Obsidianсемантический поискembeddingsвекторный поискTypeScriptлокальный индексLocalVectorStoreOpenRouterOllamaVault Audit AI
Habr
RU

Шесть лет разработки Telegram-бота: от токенайзера до LLM, RAG и векторных баз

Ио — это LLM-бот для Telegram-чатов. Он умеет отвечать на сообщения пользователей, распознавать изображения и голосовые сообщения, учитывать текущий…

telegram botllm-моделиragвекторные базы данныхvector searchpostgresqlembeddingsai
Habr
RU

Карточки из музыкальной студии 1975 года против продуктовых тупиков

Есть задачи, которые вроде бы не выглядят тупиком. Всё уже обсудили, аргументы есть — а решение почему-то снова переезжает на следующую неделю. Я ре…

product managementискусственный интеллектdeepseeknext.jsllmembeddingssqliteuxproduct designproduct discovery
Habr
RU

Персонализация без Big Data: как мы ранжируем новости в Telegram с помощью pgvector и пяти сигналов

У меня накопилось 23 Telegram-канала. Не потому что я специально их коллекционировал. Просто со временем подписывался на новые. В какой-то момент по…

рекомендательные системыrankingembeddingsmachine learning
Habr
RU

Contextual Retrieval: техника, которая чинит главную проблему RAG за 50 центов на тысячу чанков

Классический RAG часто ошибается не из‑за слабой embedding‑модели, а потому что чанки теряют связь с исходным документом. Разбир…

RAGContextual RetrievalLLMembeddingsBM25rerankingчанкивекторный поискбаза знанийкорпоративный ИИ
Habr
RU

Сжатие декодерных эмбеддеров: как ужать 8B до продакшена без потери recall

Декодерный эмбеддер 7–8B дает качество, но платит за него памятью, latency и деньгами. Разбираем все оси сжатия - int8, int4, binary + rescoring, PQ…

сжатие эмбеддинговквантизацияэмбеддингиembeddingsRAGQdrantQwen3binary quantizationMatryoshkaretrieval
Habr
EN

Embeddings Magic

Transforming language into geometry. Introduction Embeddings are one of the most important building blocks of modern AI applications, yet they're of…

aivectordatabaseembeddings
Dev.to
RU

В 14 раз быстрее: как мы ускорили генерацию эмбеддингов в Manticore через ONNX

Когда мы выпустили  Auto Embeddings  — функцию автоматического преобразования текстов в векторные представления — без развёртывания отдель…

onnxonnx runtimeonnxruntimeembeddingsэмбеддингиинференсвекторный поискvector search
Habr
RU

Как выбрать эмбеддинг для проекта

Эмбеддинги (иначе говоря, векторные представления) — это способ представления абстрактных данных в виде набора чисел (в виде векторов, как вы могли…

aiэмбеддингикак выбрать эмбединггайд на эмбедингembeddingsLLMdocumentationdocument-oriented databasesкак подключить embeddingвекторная база данных
Habr
RU

Где заканчивается вызов LLM и начинается backend система: локальный RAG на FastAPI и Ollama

Хотел разобраться где заканчивается простой вызов локальной LLM и начинается backend система. Сначала всё выглядело просто: frontend отправляет вопр…

ragllmfastapiollamapythonbackendembeddingsvector storerequest_idлокальная llm
Habr
RU

Retrieval в 2026: как RAG переехал с энкодеров на LLM (и что с этим делать в своём проекте)

Если вы строили RAG в 2023, ваш стек выглядел плюс-минус одинаково. BERT-семейство (BGE, e5) для семантики, BM25 для буквальных совпадений, cross-en…

RAGэмбеддингиembeddingsretrievalLLMQwen3Qdrantvector searchhard negativesLLM2Vec
Habr
RU

Как мы боремся с галлюцинации AI Master: гибридный Guard на Embedding + LLM Extractor на примере AI-RPG «Стирая Грань»

Каждый, кто пробовал создавать текстовые RPG или симуляторы на базе LLM (будь то GPT-4, DeepSeek или локальная 70B), сталкивался с проблемой «Yes-An…

LLMgamedevNLPembeddingspythondeepseekгеймдизайнискусственный интеллектrpgархитектура
Habr
RU

Раннее завершение KNN-поиска в Manticore Search

Современные поисковые системы уже не просто сопоставляют ключевые слова. Когда вы ищете «уютный детектив, действие которого происходит в Париже», а…

knnknn-searchвекторный поисксемантический поискhnswembeddingsoversamplingполнотекстовый поиск
Habr