Отпустить нельзя держать: где поставить гардрейл, чтобы агент не сошёл с рельсов
Программный комитет ещё не принял решения по этому докладу
Целевая аудитория
Тезисы
Агентные системы дают бизнесу реальную пользу: автоматизация, скорость, масштабирование. Но чтобы запустить агента в продакшн, нужно решить задачу, которую не решает сама LLM — как контролировать, что он делает, что видит и что отдаёт пользователю.
В докладе разберём, как работают гардрейлы на практике: почему «просто запрети» и «просто доверяй модели» — оба нерабочих сценария, как устроена многоуровневая система контролей в агентной платформе, как атакуют гардрейлы (и что из этого работает в реальности), и где проходит инженерный компромисс между безопасностью и пользой.
Из доклада аудитория унесёт конкретную архитектуру и чеклист для запуска агента в продакшн — не теорию, а паттерны из реальных систем.
Прошел путь от стажера-инженера внедрения средств защиты до старшего инженера по информационной безопасности в Яндекс 360. Строил системы защиты для крупнейших российских компаний. Увлекается безопасностью ИИ и ИИ в безопасности, Kubernetes security, выступает на конференциях, пишет статьи на Хабр и любит делиться своим опытом.
Более 10 лет в AppSec: выстраивал безопасность в компаниях, учил и вдохновлял студентов на разных курсах и CTF. Сейчас совместно с командой создаём комплексный подход к безопасности AI‑агентов.
Видео
Другие доклады секции
Агентная платформа