RU

«Давай ты не заметишь этот баг»: агенты научились сговариваться. Какой обвес нужен AI-агентам в 2026

Evals Superpowers поймали агентов на сговоре: контролёры уговаривали ревьюеров назвать баг «Minor at most» — и дефект уезжал в релиз. Автор того же Su…

Claude CodeCodexAI-агентыMCPLLMоркестрацияharness
Habr
RU

Как мы внедряли ИИ на 500 инженеров, а скорость не росла. Часть 2. Почему AI-first команды не делают нас быстрее

В первой части статьи мы пришли к выводу, что само использование ИИ не ускоряет инженерную систему. Можно вырастить MAU LLM, потом MAU API, раздать лю…

agentic engineeringai-first командыкодинг-агентыllmsdlcmau apiинженерная эффективностьхакатоныворкшопыharness
Хабр — Управление
RU

Промпты, RAG, LLM-тюнинг, Harness… Идём дальше?

Автономная диагностика СУБД требует от LLM-агента не просто генерации текста, а точной последовательности действий: сбора телеметрии, анализа планов з…

harnessmeta-harnessпаретодискретная оптимизацияprompt tuningRAG tuningharness engineeringmeta-agentmeta-llmllm as a judge
Habr