RU

Я постоянно говорил, что все зависит от контекста, но не стал системным архитектором, или почему контекст важнее промпта

Разбираю, как мем про системных архитекторов повлиял на мою работу. Делюсь своим опытом формирования контекста для ИИ агента в двух разных кейсах. Ч…

context engineeringclaude codeai-агентыmcpметрики разработкипромпт-инжиниринг
Habr
RU

Вы внедряете AI неправильно и что такое контекстный долг

Создать AI-агента стало легко. Сложно понять, где он действительно нужен. Разбираю на своем опыте, что такое контекстный долг и как он помогает нахо…

контекстный долгcontext debtуправление знаниямиИИ в разработкеAI-агентыAI-автоматизациябизнес-процессыавтоматизация процессовcontext engineeringметрики процесса
Habr
RU

Status Line для Claude Code CLI. Показывает кэш, git, контекст и лимиты в одном месте

Сделал Status Line для тех, кто пользуется Claude Code CLI Если вы работаете с клодом в терминале, то в одном месте он показывает: • Модель и Effort…

Claude CodestatuslineтерминалCLIAI-агентыконтекстное окноprompt cacheGitNode.jscontext engineering
Habr
RU

Почему нейросети съедают токены: что происходит с длинными чатами и как снизить расход

Один пользователь Claude утверждает, что прогнал через модель больше миллиарда входных токенов. Другой оставил AI-агента без присмотра и насчитал ок…

LLMтокеныконтекстное окноClaudeChatGPTcontext rotprompt cachingAI-агентыcontext engineeringрасход токенов
Habr
RU

Я объяснил KERNEL маме за пять минут. Потом проверил, переживёт ли он LLM в production

Недавно я попробовал объяснить маме, как нормально ставить задачи ChatGPT. Без temperature, context window, system prompt и прочих слов, после котор…

LLMprompt engineeringKERNELпромптыcontext engineeringevalsChatGPTRAGAI-агентыLLM в production
Habr
RU

ИИ‑агенту недостаточно правил: как мы передаём ему инженерный опыт

Промпты, документация и skills сами по себе не передают ИИ‑агенту инженерный опыт. Рассказываю, как мы выстроили работу через декомпо…

ИИ-агентыагентная разработкаразработка ПОcontext engineeringfew-shotskillsтестированиеcode reviewинженерные практикиавтоматизация разработки
Habr
RU

Ваш агент не тупой — ему просто неудобно

Инженеры тонут в ревью сгенерированного кода, продакты хвастаются фичами без программистов. Почему агент буксует в вашем репозитории и как это измер…

context engineeringагентская разработкаAI-агентыClaude Codecode reviewкачество кодаDevOps
Habr
RU

Инженерия вокруг агента: 10 идей AI Engineer

10 идей конференции AI Engineer о том, как меняется разработка, когда код пишут агенты. В начале 2026 года небольшая команд…

AI-first разработкаAI-агентыharness engineeringcontext engineeringпамять агентовagent loopsмультиагентные системыверификация кодаавтономность агентовagentic security
Habr
RU

Контекстная инженерия: что это такое, как работать с контекстом и почему за это начали платить

Вы собрали диалоговую систему — агента с RAG, инструментами и памятью. На коротких диалогах всё работает: модель выбирает нужный инструмент и достаё…

контекстная инженерияcontext engineeringllmии-агентыragmcpпромпт-инжинирингконтекстное окнобольшие языковые моделиtool calls
Habr
RU

Когда контекстное окно кончается, а проект — нет

Браузерная игра на 114 тысяч строк, целиком написанная с помощью нейросетей за три недели. Не про то, что ИИ умеет код, а про то, что удерживает бол…

context engineeringagents.mdархитектура систембраузерная играtypescriptralphexai-агенты в работеоркестраторecsvibecoding
Habr
RU

Харнесс вокруг кодящего агента, или Как я создал собственного монстра

Качество работы с кодящим агентом почти не зависит от того, какая под капотом модель. Я довольно долго в это не верил — менял модели, крутил промпты…

claude codeии-агенты для разработкихарнессcontext engineeringagentic coding
Habr
RU

Evals для чайников. Как тестировать AI-агента, чтобы понимать, где именно он ломается

Большинство команд оценивают производительность AI-агентов через end-to-end метрики: success rate, количество токенов, tool usage, стоимость запроса…

ai-агентыllmragevalsorchestrationretrievaltool callingcontext engineeringproductionai infrastructure
Habr
RU

Чем умнее модель, тем меньше ей нужно: четыре дисциплины production‑агента

Если твой агент обвешан пошаговыми инструкциями и десятком узких инструментов под каждый шаг — он, скорее всего, работает хуже, чем мог&nb…

AI-агентыproduction-агентыcontext engineeringинженерия контекстаAnthropicClaudeLLMAgent Skillsпромпт-инжинирингtool design
Habr
RU

Мультимодальность в ИИ-агентах: картинки на вход, картинки на выход и отказ от Multimodal RAG

На связи Сергей Смирнов, AI-инженер и основатель LLMStart.ru. Сегодня разбираем мультимодальность в ИИ-агентах на реальном примере из продакшена. Мы…

RAGmultimodal RAGмультимодальностьvision LLMimage-onlyColPaliCLIPLLM-агентыLangChaincontext engineering
Habr
RU

Память на миллион, а толку ноль: как мы спасали ИИ-агента от «тупости»

На связи Сергей Смирнов, AI-инженер и основатель LLMStart.ru. Сегодня разбираем горячую тему, на которой спотыкаются многие разработчики ботов — пам…

LangChainИИ-агентыRAGcontext engineeringLLMAI-driven разработкаllmstartконтекст-инжинирингproductionproduction-ready
Habr
RU

Почему ломается ваш AI-агент — и почему смена модели обычно его не чинит

Представьте внутреннего AI-агента, который помогает компании искать общие документы и управлять ими. Он работает. До тех пор, пока 12–15% запросов н…

ai-агентыllmragorchestrationretrievaltool callingcontext engineeringevalsproductionai infrastructure
Habr
RU

От RAG-прототипа к агенту в продакшн: путь по метрикам, а не по моде

На связи Сергей Смирнов, AI-инженер LLMStart.ru. Сегодня расскажу о полноценном кейсе, который мы делали для компании Айтон: агенте-консультанте по…

RAGLLMИИ-агентыLangChainLangFuseRagasметрики качестваcontext engineeringмультимодальностьии
Habr
RU

Harness вокруг LLM: что я понял за полтора года ежедневной работы

Полтора года в Claude Code, несколько релизов моделей, десятки экспериментов с командой в Kaiten. Всё это время я ждал, что главным рычагом качества…

LLMClaude CodeAI-агентыprompt engineeringharnessAnthropiccontext engineeringAgent Skillsllms.txtvibecoding