RU

Garmin записывает всё. ChatGPT — ничего. Разрыв длиной в один вечер и один скрипт

Garmin записывает почти всё: сон, HRV, стресс, Body Battery, пульс на тренировке, каждый подход в зале. ChatGPT ничего этого не видит. Чтобы спросит…

GarminGarmin Connectopen sourceself-hostedTelegram-ботLLMOllamaPythonAI-агентфитнес-данные
Habr
RU

Я научил Obsidian искать по смыслу. Как устроен локальный семантический индекс без отдельной векторной БД

В комментариях к прошлой статье мне написали примерно следующее: граф связей выглядит красиво, но хороший поиск по заметкам полезнее. Спорить было т…

Obsidianсемантический поискembeddingsвекторный поискTypeScriptлокальный индексLocalVectorStoreOpenRouterOllamaVault Audit AI
Habr
RU

Один интерфейс — девять LLM-провайдеров: как мы подружили Kimi K3, GLM-5.2, Claude и Ollama в одном терминальном агенте

Привет, Хабр! Я делаю execai — терминальный AI-агент на Go (bubbletea), в духе Claude Code. Он читает файлы, гоняет shell-команды, ходит в kubernete…

execaiGoLLMKimi K3GLM-5.2OllamaAI-агенттерминалbubbleteaSSE
Habr
RU

«Свой» уходит в опенсорс: вайб-темы, RAG поверх шифра и объектив, который знает контекст

Свой open source ИИ-ассистент. Ассистент - который помнит вас между разговорами - ищет по вашим документам и по вебу - умеет планировать - работать…

LLMRAGИИ-ассистентopen sourceGoOllamaBYOKvisionSearXNGsqlite-vec
Habr
RU

Теги реакций и собираемый промпт: как удержать характер ИИ-персонажа по ходу диалога

Вектор диалога с LLM плывёт каждый ход, и к концу разговора персонаж уже не тот. Рассказываю, как я это чиню в своём движке: классификатор выбирает…

LLMпромпт-инжинирингprompt engineeringconstrained decodingstructured outputИИ-персонажичат-ботыконсистентность диалогаOllamagemma
Habr
RU

Локальная RAG-система на Go, PostgreSQL и Ollama без облачных API

RAG уже стал стандартным способом научить LLM работать с собственными документами без дорогостоящего дообучения. Но за кажущейся простотой скрываетс…

RAGRetrieval-Augmented GenerationGogolangPostgreSQLOllamaэмбеддингивекторный поисклокальные моделиllm
Habr
RU

Сотрудники сливают данные в чужой ИИ. Разбираемся чем это грозит

За последний год я провёл серию корпоративных тренингов по использованию ИИ для рабочих офисных задач — в разных по ра…

персональные данныеутечки данныхChatGPTлокальные LLMOllamaРоскомнадзоринформационная безопасность152-фз
Habr
RU

Как заставить LLM проанализировать хранилище из тысяч заметок, которое не влезает в контекст

У меня в Obsidian накопилось под две тысячи заметок. Ежедневники, конспекты, обрывки идей, недописанные черновики. Граф‑вью честно по…

ObsidianLLMMapReduceплагинTypeScriptOpenRouterOllamaаудит базы знанийRAG
Habr
RU

Кто ворует ваш GPU: атаки на открытые LLM-эндпоинты (Ollama, llama.cpp) — и при чём тут кража облачных ключей

Коротко тезис: открытый Ollama — это бесплатный GPU для атакующего , и охота за таким compute давно поставлена на поток. Но за май наша сеть ханипот…

LLMOllamallama.cpphoneypotSSRFIMDSинформационная безопасностьGPUn8n
Habr
RU

PewDiePie: разбираю self-hosted AI-workspace, который собрал 47 тысяч звёзд за пару дней

PewDiePie последние полтора года ушёл из развлекательного контента в технику: домашний сервер, локальные LLM, self-hosting. Результат — репозиторий…

self-hostedAI workspaceлокальные LLMOdysseusPewDiePieOllamaDockeropencodeприватность
Habr
RU

Как я сделал локальный RAG-сервис для SRE: ищем по документации, ранбукам и коду через Ollama

Недавно делал учебный проект про автоматизацию документирования инцидентов. Поначалу планы были грандиозными: инциденты, таймлайны, интеграции с мон…

RAGLLMFastAPIPythonOllamaOpenWebUIBM25SREранбукиOpenAI-compatible API
Habr
RU

Почему RAG — это не просто «добавить поиск»: latency, качество и выбор стратегии retrieval

Когда говорят про RAG, его часто описывают как простой способ улучшить LLM‑систему: добавить поиск по внешним данным, найти релевантн…

RAGLLMretrievallatencyChromaOllamavector searchembeddingstop-kchunk size
Habr
RU

Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM. Часть 4. Тестирование

Продолжаем серию про файнтюнинг и создание DevOps-агента Oni. В первой части я собирался в отпуск и хотел, чтобы локальная моделька через OpenClaw с…

тестирование ИИagent evaluationQwen3.5файнтюнингDevOps-агентLLMбезопасность ИИprompt injectionOllamaLLM safety.
Habr
RU

Внедрение ИИ‑агента в бизнес‑процесс за один день: от развертывания до прототипа

Когда руководитель просит «внедрить ИИ в бизнес‑процесс», обычно за этим стоит неприятная реальность: бюджета нет, данные нельзя отдавать…

ИИ-агентлокальная LLMOllaman8nавтоматизация процессовRAGпромпт-инжинирингбизнес-процессылокальная модельпрототипирование
Habr
RU

Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM.Часть 3.Дистилляция

Третья часть про DevOps-агента Oni. В первой статье я встретился с реальностью — локальные модели не справляются с простыми задачами. Во второй разб…

LLMфайнтюнингfine-tuningLoRADevOps-агентOllamaобучение LLMcatastrophic forgettingUnslothAI-агент
Habr
RU

SocratiCode: разбираю MCP-сервер, который даёт ИИ-агенту понимание кодовой базы

Если ваш ИИ-агент при каждом вопросе начинает grep-ом по всему проекту — у меня есть для вас одна штука. SocratiCode — это MCP-сервер, который индек…

MCPClaude Codeвекторный поискQdrantOllamacodebase intelligenceAI-агентыRAG
Habr
RU

Как устроен Meshtastic, зачем он нужен и как я подключил его к локальной модели на ноутбуке

Практический эксперимент с Meshtastic: две Heltec ESP32 LoRa 32 V4, связь на 702 м в городской среде, разбор LoRa-настроек, ролей нод, MQTT и Python…

MeshtasticLoRamesh-сетьOllamaлокальная LLMPythonHeltec ESP32 LoRa 32 V4MQTToff-gridIoT
Habr