Отпустить нельзя держать: где поставить гардрейл, чтобы агент не сошёл с рельсов

Агентная платформа

Архитектурные паттерны
Безопасность программного кода, SQL и прочие инъекции
Атаки
Безопасность
Безопасность инфраструктуры
Инструменты

Программный комитет ещё не принял решения по этому докладу

Целевая аудитория

Инженеры, которые строят агентные системы, пишут агентов на LangChain, собственных фреймворках. Они уже столкнулись с вопросом «а что если агент сделает что-то не то» — и пока не знают как это архитектурно решать. Архитекторы, которые принимают решения о том, как устроена платформа. Им нужно понять, что гардрейлы — это не фича на потом, а часть архитектуры с первого дня. ML-инженеры, которые переходят от моделей к агентам знают как обучать и деплоить модели, но агент — другой класс системы. Непривычно думать об угрозах на стыках компонентов, а не внутри модели. Доклад даёт новый угол.

Тезисы

Агентные системы дают бизнесу реальную пользу: автоматизация, скорость, масштабирование. Но чтобы запустить агента в продакшн, нужно решить задачу, которую не решает сама LLM — как контролировать, что он делает, что видит и что отдаёт пользователю.

В докладе разберём, как работают гардрейлы на практике: почему «просто запрети» и «просто доверяй модели» — оба нерабочих сценария, как устроена многоуровневая система контролей в агентной платформе, как атакуют гардрейлы (и что из этого работает в реальности), и где проходит инженерный компромисс между безопасностью и пользой.

Из доклада аудитория унесёт конкретную архитектуру и чеклист для запуска агента в продакшн — не теорию, а паттерны из реальных систем.

Прошел путь от стажера-инженера внедрения средств защиты до старшего инженера по информационной безопасности в Яндекс 360. Строил системы защиты для крупнейших российских компаний. Увлекается безопасностью ИИ и ИИ в безопасности, Kubernetes security, выступает на конференциях, пишет статьи на Хабр и любит делиться своим опытом.

Более 10 лет в AppSec: выстраивал безопасность в компаниях, учил и вдохновлял студентов на разных курсах и CTF. Сейчас совместно с командой создаём комплексный подход к безопасности AI‑агентов.

Видео

Другие доклады секции

Агентная платформа