RU

FlautGuard: как мы построили многоуровневую защиту LLM от prompt injection и утечек данных

Защита языковой модели отличается от защиты обычного веб-приложения одной принципиальной особенностью: пользовательский ввод для LLM — это не только…

LLMprompt injectionбезопасностьискусственный интеллектмашинное обучениенейронные сетиинформационная безопасностьбезопасность llm
Habr
RU

Тот самый харнесс который мы заслужили в эпоху, когда безопасность ИИ уже не диковинка

Если запустить любую передовую языковую модель из коробки и попросить ее провести тестирование безопасности агентной системы или собрать актуальный…

ai securityllm securityии-агентыбезопасность иихарнессdeepseekpaper-to-pochermesprompt injectionappsec
Habr
RU

Zero Trust для ИИ-агентов: почему отдельной идентичности недостаточно

Привет, Хабр! Меня зовут Денис Корбаков, я технический директор «Смарт-Софт». Мы разрабатываем NGFW и регулярно разбираем, какие сетевые события мож…

Zero TrustИИ-агентыIAMмашинная идентичностьworkload identityprompt injectionMCPNIST SP 800-207SPIFFENGFW
Habr
RU

Летальное трио агентской разработки: как ИИ-агенты открывают доступ к инфраструктуре и что с этим делать

Привет, Хабр! Я Денис Макрушин, работаю в Яндексе, и вместе с командой SourceCraft Security   строю платформу для безопасной агентской разработ…

ai securityagentic engineeringai red teamingИИ-агентыагентская разработкабезопасность ИИбезопасная разработкаLLM securityprompt injectionRAG poisoning
Habr
RU

[Перевод] Теневой ИИ в CI/CD: моделирование угроз на пути от ноутбука разработчика до Kubernetes

Искусственный интеллект становится частью повседневной поставки ПО — часто ещё до того, как становится частью архитектуры безопасности. У этого разр…

vk cloudтеневой ииai securityci_cdthreat modelingkubernetes securitysupply chain securityprompt injectionpolicy as codedevsecops
Habr
RU

Самая опасная уязвимость — интеллект атакующего агента?

Сейчас уже не удивляет, что агенты работают с терминалом, БД, браузером и инфраструктурой - без прямого контроля человека. Но чем шире полномочия аг…

ai securityllm securityавтономные агентыai agentsинформационная безопасностьthreat modelingtaxonomiesprompt injectiongoal hijackingmitre attack
Habr
RU

Внутри ИИ‑Напарника: как работает оркестр агентов в ритейле

Всем привет! Это Алексей из GlowByte. В прошлой статье я говорил о том, почему категорийный менеджер в большой сети часто чувств…

искусственный интеллектglowbyteмультиагентные системыdata engineeringllmprompt injectionинформационная безопасностьритейлавтоматизация бизнесаархитектура платформы
Habr
RU

416 тестов и кнопка «снести все»: где ломаются агентные проекты

С февраля у меня на ноутбуке крутится автономный агент Сурок: Claude Code, флаг --dangerously-skip-permissions и ральф-луп поверх. Работает — сидишь…

ИИ-агентыLLMагентный харнессClaude Codeprompt injectionэвалыавтономия агентоврегресс-тестыAI-DISRUPT PDLCинженерные практики
Habr
RU

Агенты удаляют файлы, сливают данные и сами себя взламывают: как устроена безопасность ИИ‑систем в 2026 году

Привет, Хабр! Тема искусственного интеллекта за последние несколько лет набили, честно говоря, оскомину. Есть как защитники, так и противн…

prompt injectionискуственный интеллекткибератакиии-агенты
Habr
RU

Как желание быстрее читать чужой код превратилось в войну с недетерминизмом LLM

Началось всё примерно так. Я сидел над своим проектом: пока работал, общался по нему с нейросетками и параллельно искал в&n…

LLMprompt engineeringдетерминизмJavaоценка кодаобучение программированиюGemini APIprompt injectionpet projectNLP
Habr
RU

Иллюзия контроля: почему промпты не защищают ИИ‑агентов

Почему указание вида «не отправляй конфиденциальные данные наружу» не работает? Разбираем уязвимость Permission Boundary Bypass, а также т…

redteamllmprompt injectionjailbreakai-агентыllm securityindirect prompt injectionбезопасность данных
Habr
RU

Как сделать MCP-сервер из Spring-сервиса за один вечер. И что потом не даст спать спокойно

AI‑агенту не нужен прямой доступ к базе, чтобы отвечать на вопросы оператора или вызывать действия в системе. Достаточно да…

MCPSpring AIJavaSpring BootAI-агентыLLM-интеграциимикросервисыбезопасность LLMprompt injectionархитектура ИИ-приложений
Habr
RU

Сайты под управлением ИИ: как это работает под капотом. Часть 2 из 3

Сайты под управлением ИИ: что это на самом деле и сколько стоит. Часть 1 Это вторая часть из трёх. В первой мы разбирались с концепцией: что такое с…

LLMMCPNext.jsheadless WordPressGitHub Actionsprompt injectionJSON-LDISRDevOps
Habr
RU

Скачал skills по совету из YouTube — слил все свои данные. Как это работает?

Представьте: вы посмотрели ролик на YouTube о том, как настроить ИИ‑ассистента для работы. Автор советует поставить пару‑тройку…

AI-агентыskillsкибербезопасностьClaude Codeprompt injectionвредоносный кодскилы для новичковии-безопасность
Habr
RU

Prompt injection нельзя запатчить: год «летальной триады» и лента CVE 2026 года

В марте 2026-го бэкдор пролежал на PyPI около трёх часов. За это время заражённый пакет скачали почти 47 тысяч раз. Пакет назывался LiteLLM — это шл…

prompt injectionИИ-агентыLLMинформационная безопасностьлетальная триадаOWASPEchoLeakCaMeLagentic AIMCP
Habr
RU

Как мы автоматизировали мониторинг цен конкурентов: мультиагентная система на CrewAI + n8n + Firecrawl

0. TL;DR для тех, кто спешит Статья о том, как собрать из подручных open-source инструментов систему, которая ежедневно: — Сканирует цены и отзывы у…

n8nfirecrawlllmagentspythonпарсингмониторинг цен конкурентовe-commerceai-безопасностьprompt injection
Habr
RU

Влияние ИИ на кибербезопасность: MITRE ATLAS и новый ландшафт угроз

Сегодня искусственный интеллект кардинально меняет как подходы к защите, так и методы атак. С развитием технологий ИИ-модели могут обрабатывать и ан…

AI FirewallMITRE ATLASprompt injectionSAFE-AIзащита AI моделейбезопасность ИИ
Habr
RU

Промпт-инъекции в реальных данных, широкие права доступа и другие способы сломать ИИ-агента

Привет, Хабр! На связи команда Jay Guard — платформы, которая помогает безопасно использовать языковые модели и ИИ-агентов. Недавно мы опубликовали…

ии-агентыинформационная безопасностьбезопасность данныхllmprompt injectionагентные системызащита данныхперсональные данныеai agentsбезопасность llm
Habr
RU

Zero Trust для AI-агентов: как безопасно давать LLM доступ к инструментам, данным и действиям

AI-агенты уже вышли за пределы чат-ботов. Они читают документы, вызывают API, анализируют логи, создают тикеты, готовят правки в коде и выполняют мн…

aillmai agentanthropicopenaiclaudecodexzero trustprompt injection
Habr
RU

Хотел упростить мониторинг проектов и в отпуск — пришлось обучать свой LLM. Часть 4. Тестирование

Продолжаем серию про файнтюнинг и создание DevOps-агента Oni. В первой части я собирался в отпуск и хотел, чтобы локальная моделька через OpenClaw с…

тестирование ИИagent evaluationQwen3.5файнтюнингDevOps-агентLLMбезопасность ИИprompt injectionOllamaLLM safety.
Habr
RU

Вы пустили ИИ-агента в репозиторий, теперь разбираемся, что он может сломать

В феврале 2026 года Claude Cowork стирает 15 лет семейных фотографий одной командой. За полгода до этого, в августе 2025-го, случился…

ИИ-агентыбезопасностьOWASPsupply chainClaude Codeprompt injectionDevSecOps
Habr