RU

Один интерфейс — девять LLM-провайдеров: как мы подружили Kimi K3, GLM-5.2, Claude и Ollama в одном терминальном агенте

Привет, Хабр! Я делаю execai — терминальный AI-агент на Go (bubbletea), в духе Claude Code. Он читает файлы, гоняет shell-команды, ходит в kubernetes …

execaiGoLLMKimi K3GLM-5.2OllamaAI-агенттерминалbubbleteaSSE
Habr
RU

Shorts Maker v2: как я превратил AI-генератор видео в возобновляемый production pipeline на Python

Как превратить работающий AI-прототип в надёжный production pipeline? Разбираю архитектуру Shorts Maker v2 — генератора коротких видео на Python с DDD…

PythonAIгенеративный ИИгенерация видеоShortsReelsClean ArchitectureDDDFFmpegLLM
Habr
RU

Как перейти в ИТ и создать мобильное приложение с ИИ: история разработчика «ЧитКита»

Наталья Новикова пришла в разработку из ветеринарии и начинала как самоучка — с курсов по Java. В рамках дипломного…

искусственный интеллектразработка мобильных приложенийстартапFlutterGoPythonRAGLLMмашинное обучениеразработка IT-продукта
Habr
RU

Почему идеальная LLM всё равно не сделает агентные системы предсказуемыми

Представьте LLM, которая никогда не галлюцинирует, никогда не ошибается. На один и тот же запрос всегда выдаёт один и тот же …

LLMмногоагентные системыхаосгаллюцинацииai-агенты
Habr
RU

LLM-судье нельзя верить на слово: как построить надёжный гейт и проверить сами тесты

Как перестать доверять LLM-судье на слово и построить безопасную двухконтурную систему оценки? Внутри статьи: Архитектурный паттерн сдерживания: почем…

LLMLLM-as-a-judgeLLMOpsPythonтестированиевалидация моделейархитектура системкаппа Коэнакачество данных
Habr
RU

Модель не виновата: разбираем 3 громких ИИ-инцидента, которые случились из-за отсутствия архитектуры

Я проектирую системы на LLM, и после каждого громкого ИИ‑инцидента мне прилетает одна и та же ссылка с одним и тем же вопросом: «а…

LLMархитектура ПОClaudeИИ-агентыотказоустойчивостьвалидация данныхproductionAnthropicstructured outputshuman-in-the-loop
Habr
RU

Рентген для нейросетей, или как я перестал понимать собственный ИИ и написал свой APM

Бывало у вас такое: месяцами пилишь архитектуру, фичи летят одна за другой, тесты зелёные. Всё работает. А потом в какой-то момент ловишь себя на мысл…

observabilitytracingX-RayFastAPIAILLMархитектураотладкаPAD+ AIтрассировка
Habr
RU

Заменит ли Джун Сеньора, если дать ему ИИ?

В прошлой статье мы выяснили, что при остановленном найме сегодняшний Джун не может превратиться в классического старого матёрого Сеньора, руину герои…

вайб-кодингджунысеньорыИИ-ассистентыLLMархитектура ПОпроектирование системрынок труда в ITнайм разработчиковтехнический долг.
Habr
RU

Domain-routed agents vs naive RAG: экономика и риски архитектурного выбора

Классический RAG хорошо ищет отдельные факты, но может пропускать исключения и связи между разными разделами документации. Я проверил альтернативный п…

RAGLangGraphагентымультиагентные системыИИPythonархитектураNLPLLMllm-архитектура
Habr
RU

Гибель богов. Fable и ещё 10 LLM реорганизуют код. Сравнение

Это подробный разбор одного эксперимента. Я взял god node из реального LangGraph агента и попросил 5 американских и 6 китайских моделей сначала предло…

LLMLangGraphИИ-агентырефакторингнейросетиDeepSeekFableLLM-as-a-judgeархитектура ПОбенчмарки LLM
Habr
RU

PAD+ AI v4.0: исследовательская когнитивная архитектура поверх LLM

Большинство AI‑приложений — это просто «запрос → LLM → ответ». PAD+ AI исследует, что должно происходить между этими шагами. Мы построили от…

LLMкогнитивная архитектураRAGFastAPIReactнаблюдаемостьX-Rayпамять AITruth Loopopen-source
Habr
RU

Как мы встроили ИИ-агентов в платформу: архитектура, сценарии, безопасность

ИИ-ассистент в корпоративной среде довольно быстро упирается в одно ограничение: он отвечает на вопросы, но ничего не делает. Спросить можно, но созда…

Model Context ProtocolAI-агентыLLMGenAIenterpriseITSMинтеграцииAI toolsRAGgenai-платформа
Habr
RU

65 бесплатных уроков июля: от LLM и RAG до Kubernetes, Go и QA

Профессиональный рост часто упирается в конкретные слепые зоны: где демо AI-агента расходится с продакшеном, как выбирать платформу для AI-ворклоадов,…

LLMragkubernetesGoтестированиеархитектураинфраструктураподорка вебинаровбесплатные урокипрофессиональное развитие
Habr
RU

AI‑агенты в проде: 6 архитектурных ошибок, из‑за которых они не доживают до запуска

На демо AI‑агент может выглядеть надёжным: вызвать инструменты, собрать ответ и отчитаться об успехе. Но в продакшене быстро …

AIAI-агентыLLMархитектураproductioncontext-engineeringobservabilityмультиагентные-системынадёжность
Habr
RU

Почему я перестал слать каждый вопрос в LLM: архитектура предсказуемого конвейера

Очевидный путь для бота поддержки на LLM — слать в модель каждый вопрос вместе с куском базы знаний. На демо работает, в проде разваливается: галлюцин…

ТехподдержкаLLMRAGчат-ботклассификация обращенийYandexGPTDeepSeekNLPFastAPI
Habr
RU

Архитектура ИИ-агента с желаниями или цифровой человек

У меня обычно так: я довожу проект до прототипа, доказываю себе, что моя идея работает — и теряю интерес. Проект lifemodel — один из таких. Это ИИ-аге…

ИИ-агентпроактивный агентLLMархитектура ПОавтономный агентheartbeatцифровой компаньонпесочницаDockerагентные системы
Habr
RU

Я собрал линтер для юридического соответствия сайтов. Сложнее всего было отличить Google Analytics от CSS‑переменной

Коротко . Сервис открывает чужой сайт и считает штраф по КоАП. Внутри двухуровневая проверка по 22 правилам: дешёвые эвристики на cheer…

152-ФЗперсональные данныекомплаенсprompt cachingрегулярные выражениякириллицаLLMPlaywrightаудит сайтаNext.js
Habr
RU

Архитектура обмана. Как технически устроены фермы накрутки отзывов в 2026 году?

Подделка рейтингов окончательно перешла с бирж фриланса на автоматизированные конвейеры. Сегодня отзывы генерируют локальные LLM, а публикуют скрипты …

антифроднакрутка отзывовботофермыфейковые отзывыLLMантидетект браузерыграфовый анализfingerprintingрезидентные проксиповеденческий анализ
Habr
RU

Golden Armada: трассировки как основа наблюдаемой AI-native системы

Можно ли понимать сложную систему, вообще не читая её код? Golden Armada — экспериментальная AI-native система, в которой код перестаёт быть главным и…

AIискусственный интеллектLLMбольшие языковые моделипрограммированиеархитектура ПОsoftware architectureAI-nativeгенерация кодаcode generation
Habr
RU

Claude дал неправильную архитектуру. Настоящая ошибка была не в Claude

Один из моих крупных бизнес-проектов-бизнесов - разработка электроники и софта для БПЛА . Дошел до момента, когда на железе после MVP надо стало разве…

LLMClaude Codeархитектура ПОдеплойпостановка задачиembedded linuxбплаdevopsprompt engineering
Habr
RU

Почему мы спорим о памяти для AI-агентов

На днях наткнулся на статью про память для AI-агентов. Сама статья была вполне типичной: SQLite, хранение контекста, поиск по накопленным знаниям, эко…

AI AgentsAgent MemoryLLMAgentic AIKnowledge ManagementContext EngineeringLong-term MemoryProject MemoryRetrieval SystemsAI Architecture
Habr
RU

Chrome-расширение для Upwork: архитектура, метрики и опыт разработки с помощью ИИ

В свободное время я периодически захожу на Upwork, чтобы посмотреть, какие проекты там сейчас появляются и как устроен рынок изнутри. Если убрать филь…

ChromeExtensionUpworkLLMAIAssistedDevelopmentTypeScriptRustPostgreSQLEmbeddingsSystemArchitecture
Habr
RU

Как я сделал локальный RAG-сервис для SRE: ищем по документации, ранбукам и коду через Ollama

Недавно делал учебный проект про автоматизацию документирования инцидентов. Поначалу планы были грандиозными: инциденты, таймлайны, интеграции с монит…

RAGLLMFastAPIPythonOllamaOpenWebUIBM25SREранбукиOpenAI-compatible API
Habr
RU

Как устроены LLM-агенты: архитектура, планирование и инструменты

Если вы хоть раз просили ChatGPT выполнить какую-то задачу и получали в ответ инструкцию "как это сделать" вместо того чтобы он взял и сделал сам - вы…

LLMагентыAI agentsprompt engineeringархитектура ИИLangGraphChatGPTязыковые модели
Habr
RU

Как мы боремся с галлюцинации AI Master: гибридный Guard на Embedding + LLM Extractor на примере AI-RPG «Стирая Грань»

Каждый, кто пробовал создавать текстовые RPG или симуляторы на базе LLM (будь то GPT-4, DeepSeek или локальная 70B), сталкивался с проблемой «Yes-And»…

LLMgamedevNLPembeddingspythondeepseekгеймдизайнискусственный интеллектrpgархитектура
Habr
RU

Как Claude убедил заказчиков, что я некомпетентен

Меня удалили из рабочего чата после того, как заказчики поверили нейросети больше, чем живому специалисту, с которым работали полгода и у которого всё…

LLMвайбкодингClaude Codeискусственный интеллектделегирование мышленияуправление контекстомархитектура ПОфрилансработа с заказчикамиAI-разработка
Habr