RU

Как именно AI-агенты атаковали Hugging Face: опубликованы отчеты OpenAI и METR

В июле 2026 года внутренний эксперимент OpenAI по проверке кибервозможностей моделей вышел за пределы тестовой среды. Агенты получили доступ к интер…

METRopenaiии-агентHugging Faceавтономные агентыfailure modeкибербезопасностьоблачные сервисыметаданныевзлом
Habr
RU

[Перевод] Сколько автономности должно быть у ИИ‑агента

ИИ‑агент не должен получать больше автономности только потому, что выглядит компетентным. Автономность должна расти тогда, когда система в…

ии-агентыавтономные агентыАвтономность ииверификация ИИevalsai safety
Habr
RU

2160 раундов симуляции без кнопки «стоп». Исследование MiroFish, часть 3

Третья, заключительная статья об исследовании MiroFish, открытого стека мультиагентной симуляции общества. В первой части изложены методология и Sil…

MiroFishLLMавтономные агентымультиагентные системыаудитвоспроизводимостьopen source
Habr
RU

Самая опасная уязвимость — интеллект атакующего агента?

Сейчас уже не удивляет, что агенты работают с терминалом, БД, браузером и инфраструктурой - без прямого контроля человека. Но чем шире полномочия аг…

ai securityllm securityавтономные агентыai agentsинформационная безопасностьthreat modelingtaxonomiesprompt injectiongoal hijackingmitre attack
Habr
RU

DepthNet: платформа для “живых” автономных AI-агентов с продвинутой памятью — год спустя

Год назад я написал здесь, что собрал на PHP/Laravel AI-агента, который способен рассуждать в циклах, потестил и остановился со словами «работает, н…

llm-агентai-agentlaravelphpавтономные агентыopen source
Habr
RU

ИИ-агент 4 месяца дежурит на наших прод-логах: 113 алертов, 2 галлюцинации и фикс за 3,5 часа

Пользователи почти не сообщают о багах: напишет 1 из 0, остальные молча уйдут. На прод-логи мы посадили автономного ИИ-агента: 300 тысяч строк в сут…

ии-агентыавтономные агентымониторинглогиgrafana lokiaiopsгаллюцинации ии
Habr
RU

[Перевод] Мультиагентные системы как распределенное программное обеспечение

Добрый день,Хаброжители! Сегодня мы подготовили для вас перевод статьи. В статье рассматривается переход от взаимодействия человек-агент к полностью…

автономные агентыраспределенные системыотказоустойчивостьфункциональное программированиеerlangперевод
Habr
RU

MLE-bench: золото взято, а доказательства остались в /tmp

В апреле мой агент смог перешагнуть золотой порог на MLE-bench в агентских соревнованиях Berkeley RDI, а когда я решил показать «тот самый код, кото…

MLE-benchAI-агентыавтономные агентыAgentBeatsKaggleSpaceship TitanicLLMпровенансвоспроизводимостьGemini 2.5 Pro
Habr
RU

[Перевод] Самосовершенствующийся ИИ: что происходит внутри Anthropic

На протяжении большей части истории ИИ каждый шаг в его разработке делали люди. Но в Anthropic мы всё больше делегируем часть этой работы самим ИИ-с…

рекурсивное самосовершенствованиеClaude Codeавтономные агентыбенчмарки ИИSWE-benchпроизводительность разработчиковAnthropicискусственный интеллектавтоматизация разработкибудущее программирования
Habr
RU

Утро я потратил на план, который дольше самой задачи. И понял, что не сошёл с ума, просто работа переехала

Я всё утро вылизывал план на 1700 строк. Дольше, чем заняла бы сама задача, если бы я сел и написал её руками. И к обеду поймал себя на мысли, что я…

ИИ-агентыClaude CodeCodexавтономные агентыпланированиетипыконтрактывайбкодинг
Habr
RU

AI-агентам скоро понадобится собственный Firewall. И вот почему

За последние несколько лет искусственный интеллект незаметно перешёл очень важную границу. Сначала нейросети просто отвечали на вопросы, потом начал…

AI-агентыAI FirewallAI GatewayAI SecurityAI Governanceкибербезопасностьинформационная безопасностькорпоративный ИИавтономные агентыконтроль действий AI
Habr
RU

Автоматизация не разгрузила мне голову. Она навалила сверху

вчера читал статью про чувака, которого слили с проекта, потому что заказчики поверили вердиктам модели больше, чем живому человеку. неприятная исто…

ии-агентыclaude codecodexавтономные агентымультиагентные системыделегированиегаллюцинации llmвайбкодинг
Habr
RU

[Перевод] Фаундер написал 15 страниц про рынок и поднял на этом $10M

Привет! Меня зовут Саша Журавлев. Я основатель и управляющий партнер фонда Mento VC. Мы инвестируем в технологические компании на ранних стадиях в С…

ai-агентыагентные системыавтономные агентыплатежная системамульти-агентные системыseedвенчурные инвестициифинтехy combinatorстартап
Habr