RU

Разработчик 2.0. Следующий уровень абстракции

Вы открываете задачу и пишете одну строку: Добавь идемпотентность в API создания заказа. Через некоторое время перед вами diff в незнакомом репоз…

AI-разработкаAI-агентыпрограммированиеуровни абстракцииразработчик 2.0управление разработкойинженерные практикитестированиеAGENTS.mdавтоматизация разработки
Habr
RU

Ваш агент не тупой — ему просто неудобно

Инженеры тонут в ревью сгенерированного кода, продакты хвастаются фичами без программистов. Почему агент буксует в вашем репозитории и как это измерит…

context engineeringагентская разработкаAI-агентыClaude Codecode reviewкачество кодаDevOps
Habr
RU

Я научил роботов следить за правилами. Через два дня одно правило проследило за мной

Активно занимаюсь вайб кодингом. Есть у меня полка. Туда ложатся правила, за которые я ещё не заплатил собственной болью — потому …

AI-агентытестированиеci-cdclaude-codeвайб-кодинг
Habr
RU

Инженерия вокруг агента: 10 идей AI Engineer

10 идей конференции AI Engineer о том, как меняется разработка, когда код пишут агенты. В начале 2026 года небольшая команда …

AI-first разработкаAI-агентыharness engineeringcontext engineeringпамять агентовagent loopsмультиагентные системыверификация кодаавтономность агентовagentic security
Habr
RU

[Перевод] Новые правила контекстной инженерии для Claude 5

Ранее я уже писал о том, как лучше всего составлять промпты для нового поколения моделей Claude 5 и работать с ними итеративно, чтобы постепенно понят…

контекстная инженерияClaude 5Claude Codeсистемный промптAI-агентыпрогрессивное раскрытие контекстаCLAUDE.mdнавыки Claudeавтоматическая память AIпромпт-инжиниринг
Habr
RU

Ваш AI-агент не понимает код. Он просто очень уверенно угадывает — поэтому мы создали SLICER

AI-агенты отлично решают локальные задачи, но часто теряют связи между частями большой кодовой базы. Из-за этого изменение одной функции может незамет…

AI-агентыстатический анализграф зависимостейPythonTypeScriptMCPcode reviewрефакторингfullstackdeveloper tools
Habr
RU

Браузер вместо API: как я объединил DeepSeek, Qwen и ChatGPT в одного локального агента

Я хотел получить локального AI-агента без отдельного API для каждой модели — и превратил браузерные сессии DeepSeek, Qwen и ChatGPT в единый транспорт…

AI-агентыLLMDeepSeekQwenChatGPTPlaywrightChromiumNode.jsopen sourceVS Code
Habr
RU

Можно ли аналитику в 2026 году положиться на ИИ и агентов или ещё нет?

В какой-то момент у нас, как и у многих команд, появился соблазн проверить: а можно ли уже не просто просить AI «написать user story», а действительно…

системный анализсистемный аналитикAI-агентыИИ в аналитикеUse CaseOpenAPIAPI-спецификацияConfluenceCursorтехническая документация
Habr
RU

Разрушители мИИфов – тестируем Headroom. Правда ли умная прокся может сэкономить вам токены?

Признаю: в прошлой статье про тестирование Caveman я в конце написал, что такие инструменты, как RTK, действительно, могут помочь сэкономить токены. Я…

headroomэкономия токеновLLMClaudeAI-агентыgithubбенчмарк
Habr
RU

«Давай ты не заметишь этот баг»: агенты научились сговариваться. Какой обвес нужен AI-агентам в 2026

Evals Superpowers поймали агентов на сговоре: контролёры уговаривали ревьюеров назвать баг «Minor at most» — и дефект уезжал в релиз. Автор того же Su…

Claude CodeCodexAI-агентыMCPLLMоркестрацияharness
Habr
RU

1002 хендоффа за 60 дней: как я собрал шину координации для 12 Claude-агентов

Шестьдесят дней назад я держал всю координацию своего SaaS в голове. Двенадцать вкладок Claude Code, в каждой своя роль: тимлид, аналитик, тестировщик…

Claude Codeмультиагентные системыкоординация агентовblackboardLLM-агентыоркестрация агентовавтоматизация разработкиPythonсоло-разработкаAI-агенты
Habr
RU

Как я учил AI‑аудитора проверять сайты и не ломать отчеты

В общем, базовая история с аудитом страниц — мы каждый месяц отправляли подрядчику несколько страниц на проверку. Отбирали несколь…

AI-агентыАвтоматизацияАудит сайтовPlaywrightSEO-аудитGoogle SheetsAccessibilitySquirrelscanllm
Habr
RU

[Перевод] Как внедрять AI-агентов в легаси-код без тихих регрессий

AI-агент за пару минут отрефакторит модуль, перенесёт компонент или причешет кусок кода. Но как только в системе всплывают неявные контракты — интегра…

AI-агентылегаси-кодbrownfield-разработкарефакторингинженерное управлениеctoмиграция кодовой базыдокументация кода
Habr
RU

AI‑агенты в проде: 6 архитектурных ошибок, из‑за которых они не доживают до запуска

На демо AI‑агент может выглядеть надёжным: вызвать инструменты, собрать ответ и отчитаться об успехе. Но в продакшене быстро …

AIAI-агентыLLMархитектураproductioncontext-engineeringobservabilityмультиагентные-системынадёжность
Habr
RU

Разработчики больше не нужны? Новое исследование Anthropic на 400 000 сессий — и мой спор с ним

«Разработчики больше не нужны»? Так читается вывод нового исследования Anthropic — ~400 000 реальных сессий Claude Code за полгода. По их данным, с AI…

AI-агентыLLMClaude Codeвайб-кодингпромпт-инжинирингуправление разработкой
Habr
RU

Айсберг использования AI, или как сохранить рабочее место

Привет, Хабр! Мне грустно читать посты о том, как руководители давят на сотрудников по ускорению интеграции AI в рабочие процессы и ставят строгие KPI…

Claude CodeClaudeAI-агентымультиагентные системысубагентыLLMнейросетиMCPпромпт-инжинирингавтоматизация
Habr
RU

Бэкпорты теперь делают боты: как Valkey пустил ИИ-агентов в мейнтенанс — и удержал контроль

Valkey (форк Redis под крылом Linux Foundation) в релизном цикле 9.1 отдал ИИ-агентам рутину мейнтенанса: бэкпорт-агент сам раскатывает фиксы по ветка…

ValkeyRedisAI-агентыopen sourceбэкпортDevOps
Habr
RU

Гайды Anthropic для Fable 5 и Opus 4.8 советуют противоположное, у OpenAI — третий путь. Что менять в промптах

Когда вышел Claude Fable 5, я его подключил — и он мне не понравился. Модель объективно сильнее Opus 4.8, а работать с ней было хуже: в одном ране аге…

prompt engineeringClaudeGPTLLMAnthropicOpenAIAI-агенты
Habr
RU

Работает ли Caveman? Тестируем модный скилл для экономии токенов

Недавно копайлот перешёл на новую тарификацию, из-за которой я упёрся в месячные лимиты буквально за первую рабочую неделю. В рабочих чатиках все стал…

cavemanэкономия токеновLLMClaudeAI-агентыGitHub starsнакрутка звёздCopilotбенчмаркскам
Habr
RU

Гайды Anthropic для Fable 5 и Opus 4.8 советуют противоположное, у OpenAI — третий путь. Что менять в промптах

Когда вышел Claude Fable 5, я его подключил — и он мне не понравился. Модель объективно сильнее Opus 4.8, а работать с ней было хуже: в одном ране аге…

prompt engineeringClaudeGPTLLMAnthropicOpenAIAI-агенты
Habr
RU

Agent Team в Claude Code: когда одного агента в терминале уже не хватает

Claude Code умеет запускать не одного агента, а целую команду: одна сессия становится координатором (team lead), остальные — независимые тиммейты со с…

Claude CodeAgent TeamAI-агентысубагентыLLMAnthropicавтоматизация разработки
Habr
RU

[Перевод] Каково это — работать с Fable 5 (Mythos)

У меня был ранний доступ к первой публично доступной модели класса Mythos — Claude 5 Fable. Большинство обсуждений вокруг Mythos сосредоточено на кибе…

Claude MythosClaude Fableбольшие языковые моделиAI-агентымультиагентные системыавтономные AIClaude Codeстоимость inferenceбудущее разработкичеловек в контуре
Habr
RU

Сотня параллельных субагентов бесполезна, если они врут. Главная цифра Opus 4.8 — не бенчмарк, а честность

28 мая Anthropic выпустила Opus 4.8 — через 41 день после 4.7, каденс релизов сжался с трёх месяцев до шести недель. Цена та же, $5/$25 за миллион ток…

Claudeclaude codeOpus 4.8AI-агентыоркестрация-агентовLLMAnthropicDynamic Workflows
Habr
RU

AI обнулил benchmark и пытался шантажировать инженера. И почему это решаемо

Топовые AI-модели с 95% на SWE-bench показывают 0% и 3% на ProgramBench бенчмарке, где задачи специально не пересекаются с обучающей выборкой. Не «упа…

AI-агентыllmanthropicClaudeProgramBenchAgentic misalignmentБенчмарки LLMAI в productionБезопасность AIReliability
Habr