RU

Человек между агентом и кнопкой: почему слой подтверждения — это такая сложная инженерия

Мой агент дошёл до состояния, когда я перестал читать письма перед отправкой. Между «агент решил» и «письмо ушло» не было ничего — ни…

llm-агентыpythonsqlitehuman-in-the-loopexactly-onceтестированиемутационное тестированиеконкурентность
Habr
RU

Инженерный подход к этимологии русского (индоевропейского) праязыка и преодоление «ленивых ответов» LLM

Введение. Парадокс современных технологий Прошло четыре месяца с момента выхода в свет моей книги «Живое слово от истоков до современности. Этимолог…

системный анализсистемная инженерияискусственный интеллектllm-агентыllm-моделиэтимология
Habr
RU

Я заставил ИИ‑агента работать по протоколу тушения пожаров. За шесть дней он переписал сам себя 10 раз

В какой‑то момент я перестал доверять фразе «готово» от языковой модели. Модель при этом не врёт: она честно считает, что с…

искусственный интеллектclaude-codellm-агенты
Habr
RU

KiSinWi — AutoML-платформа с микросервисной архитектурой и мультиагентными воркфлоу

AutoML обычно отвечает на вопрос «что победило», а хотелось бы ещё знать «почему». Поэтому я собрал платформу, где обучение нейросетей ведут LLM-аге…

automlмультиагентные системыllm-агентыклассификация изображенийкомпьютерное зрениемашинное обучениeнейронные сети
Habr
RU

Зачем я сделал OntoIndex: ИИ-агенту нужна не только уверенность, но и карта кода

Когда я начал активно использовать ИИ-агентов для разработки, у меня быстро появилось странное ощущение - c одной стороны, это действительно впечатл…

llm памятьllm-моделиllm-агентыllm-архитектура
Habr
RU

Десять лет в индустрии я писал код руками. Три месяца назад перестал

После выхода Claude Opus 4.7 стало очевидно, что агент технически быстрее меня. А 28 мая Anthropic выпустила Opus 4.8 с теми же ценами, заметно лучш…

claudeclaude codeanthropicllmllm-агентыai-codingagentic codingcode reviewстатический анализcheckstyle
Habr
RU

Как собрать пайплайн с LLM агентом который фиксит нативные Android UI автотесты

Что будем делать или что может быть интересного в статье: - Пайплайн из двух независимых LLM агентов - Запуск и анализ ошибки UI автотеста (Root Cau…

llm-агентllm-агентыllm-моделиandroid developmentespressoui-тесты
Habr