Затащи меня в Harness. Часть 3: Принципы маршрутизации
Я бы назвал это самой важной частью всей серии статей. В ней мы соберём целостную картину. Будем говорить об обобщённой системе, которая принимает ест…
Latest Testing & QA news from Tech News
Я бы назвал это самой важной частью всей серии статей. В ней мы соберём целостную картину. Будем говорить об обобщённой системе, которая принимает ест…
Evals Superpowers поймали агентов на сговоре: контролёры уговаривали ревьюеров назвать баг «Minor at most» — и дефект уезжал в релиз. Автор того же Su…
В первой части статьи мы пришли к выводу, что само использование ИИ не ускоряет инженерную систему. Можно вырастить MAU LLM, потом MAU API, раздать лю…
Привет! Я Андрей Иванов, NLP-исследователь в R&D-лаборатории red_mad_robot. Когда мы собираем AI-агента, первым делом выбираем модель под задачу. …
The local test suite was green. Eleven of eleven. I told the agent we had test coverage, and I said commit and push. We shipped an SDK that had never …
Автономная диагностика СУБД требует от LLM-агента не просто генерации текста, а точной последовательности действий: сбора телеметрии, анализа планов з…
Harness Base Definition: The Control System Outside the Model Previously, we split Agent into several minimal parts: Model: judge the next step Loop: …
System Boundaries: The Difference Between ChatBot, Workflow, Agent, and Harness When people first build Agent systems, they often naturally read them …
Agent Base Definition: Why It Is Not a Prompt When many people first start building Agents, the most natural reaction is: if we make the system prompt…
How I solved a real SOC operations problem for Datadog, AWS, Cloudflare, Sysdig, PagerDuty with an AI runner, a local AI harness with a tricky model s…
AI agents are moving from personal productivity tools into operational workflows. That shift changes the security model. If employees use ChatGPT, Cla…