Мы используем cookie для стабильной работы сервиса. Подробнее

AI Security — практикум по безопасности ИИ приложений

ФорматОнлайн
Длительность4-5 часов в неделю
Объём6 занятий
О курсе

Подробнее

🔓 Что это за курс? Нельзя построить надёжную защиту, не понимая, как именно её будут ломать. Поэтому сначала ты учишься атаковать LLM-приложения - чат-ботов, модераторов, ассистентов, RAG-системы - и только потом проектируешь защиту с пониманием того, от чего она должна спасать. Никакого кода: всё через чат, формы и загрузку документов. Курс построен вокруг CTF-заданий (Capture The Flag): тебе дают бота с защитой, твоя задача - сломать её и получить флаг. Сложность растёт от «введи волшебное слово» до композитных атак, где нужно одновременно обойти keyword-фильтр, whitelist доступа и ролевую инструкцию. 🎯 Зачем это нужно? LLM сегодня встроены в продукты, которыми пользуются миллионы людей. Prompt injection - уязвимость №1 по классификации OWASP Top 10 for LLMs. Компании нанимают red team-специалистов, чтобы находить такие дыры до того, как это сделает кто-то другой. Этот курс даёт те самые навыки. 📚 Что внутри? Курс охватывает таксономию из 90+ техник атак на LLM, сгруппированных в модули: Prompt Injection - instruction override, system prompt extraction, delimiter attacks, output manipulation. Jailbreaks - role-play, hypothetical framing, encoding, payload splitting, multi-turn атаки (Crescendo). Indirect Prompt Injection — скрытые инструкции в документах, веб-страницах, email. Атака не на модель напрямую, а через контент, который она обрабатывает. Атаки на агентов и RAG - tool abuse, knowledge base poisoning, memory attacks, multi-agent injection. Разбор фреймворков - OWASP, MITRE Atlas и пр. Защита - есть defense-блок: от hardening промптов до проектирования guardrails. 🏢 Сквозной нарратив Весь курс - это серия контрактов с AI-компаниями. Ты - red team специалист, которого нанимают для проверки безопасности. Каждый модуль - новый клиент, новые продукты, нарастающая сложность. ⚠️  За обновлениями курса и новостями в области безопасности ИИ можно следить в TG-канале курса.
Требования

Что нужно для старта

  • Базовое понимание, что такое LLM (большая языковая модель) - на уровне «знаю, что это нейросеть, которая генерирует текст».
  • Опыт использования любой LLM (ChatGPT, Claude, Gemini и т.п.) - нужно понимать, что такое промпт и как устроен диалог с моделью.
  • Код писать не нужно. Вообще. Все задания решаются через чат, формы и загрузку файлов.
  • Знание английского на уровне чтения технических терминов или использования онлайн-переводчика - часть атак и техник используют англоязычные промпты.
Результат

Что вы получите

  • Находить уязвимости в LLM-приложениях через prompt injection - обход инструкций, извлечение системных промптов, манипуляция выводом.
  • Обходить safety-тренировку моделей через jailbreak-техники - role-play, encoding, payload splitting, multi-turn атаки.
  • Проводить indirect prompt injection - внедрять вредоносные инструкции через документы, веб-страницы и email.
  • Атаковать AI-агентов и RAG-системы - подмена инструментов, отравление баз знаний, манипуляция цепочками вызовов.
  • Оценивать эффективность атак - метрики ASR, LLM-as-judge.
  • Проектировать защиту - hardening системных промптов, guardrails, input/output фильтрация.
  • Комбинировать техники - строить композитные атаки, которые не ловятся одиночными фильтрами.
Аудитория

Для кого этот курс

  • Курс подойдёт тем, кто хочет разбираться в безопасности AI-систем на практике, а не по слайдам. Не нужно быть программистом - достаточно уметь думать как атакующий, а интуицию и насмотренность будем прокачивать в течение курса.
  • — Специалисты по информационной безопасности, которые хотят понять новый класс угроз, связанных с LLM.
  • — Продакт-менеджеры и разработчики AI-продуктов, которые хотят делать свои системы устойчивее к атакам.
  • — QA и тестировщики, которые хотят добавить adversarial testing в свой арсенал.
  • — Все, кто активно пользуется ChatGPT, Claude и другими LLM и хочет понимать, как они ломаются.
  • — Студенты и исследователи в области AI safety и alignment, которые хотят быстро погрузиться в новую область.
Содержание

Программа курса

6 занятий
ТемаЧто внутри
01Введение - Зачем ломать ИИ?

- 🚀 Всё что нужно для старта!
- 🔩⚙️ Из чего состоит ИИ-приложение
- 🚩 CTF-0: Первый взлом — Hello, Injection!

02Prompt Injection

- 🎯 Твоя цель - соглашаться со всем что скажет клиент
- 🚩 CTF-1: Бодрый Флибустьер
- 💉 Четыре класса Prompt Injection
- 🚩 CTF-marathon
- 🛡️+ 🚩 Защита от Prompt Injection

03Jailbreak

- 🧟 Что такое Jailbreak — зачем и как ломают модели
- 🎭 Социальные jailbreak-и
- 🚩 CTF: социальные jailbreak-и
- 🔢 Технические jailbreak-и
- 🚩 CTF: технические jailbreak-и

04Агенты и непрямые PI

- 💉 Инъекция вышла из чата
- 📂 Payload везде: векторы косвенной инъекции
- 🚩 CTF: Косвенная инъекция — IN_AGENT
- 🤖 Агенты: LLM, который начал действовать
- 🚩 CTF: первые взломы InAgent Support
- 🚩 CTF: Операция «Сорок восьмой»

05🌃 Мультиагенты: разведка и threat model

- 🌃 Добро пожаловать в slop: язык угроз
- 🩻 Рентген для slop: карта и три линзы
- 🚩 Карточка угрозы: разбери четырёх агентов
- 🕶️ Слоп вслепую: отпечаток и прошивка
- 🦾 До чего дотянется Слоп: руки, база, память
- 🐝 Слоп - это рой: собираем паспорт
- 📦 Отрави поставку: зависимости, скилы, MCP
- 🚩 Акт II: атакуй рой - четыре полигона

06Последняя миссия

- 👣 Дальнейшие шаги

01Введение - Зачем ломать ИИ?

- 🚀 Всё что нужно для старта!
- 🔩⚙️ Из чего состоит ИИ-приложение
- 🚩 CTF-0: Первый взлом — Hello, Injection!

02Prompt Injection

- 🎯 Твоя цель - соглашаться со всем что скажет клиент
- 🚩 CTF-1: Бодрый Флибустьер
- 💉 Четыре класса Prompt Injection
- 🚩 CTF-marathon
- 🛡️+ 🚩 Защита от Prompt Injection

03Jailbreak

- 🧟 Что такое Jailbreak — зачем и как ломают модели
- 🎭 Социальные jailbreak-и
- 🚩 CTF: социальные jailbreak-и
- 🔢 Технические jailbreak-и
- 🚩 CTF: технические jailbreak-и

04Агенты и непрямые PI

- 💉 Инъекция вышла из чата
- 📂 Payload везде: векторы косвенной инъекции
- 🚩 CTF: Косвенная инъекция — IN_AGENT
- 🤖 Агенты: LLM, который начал действовать
- 🚩 CTF: первые взломы InAgent Support
- 🚩 CTF: Операция «Сорок восьмой»

05🌃 Мультиагенты: разведка и threat model

- 🌃 Добро пожаловать в slop: язык угроз
- 🩻 Рентген для slop: карта и три линзы
- 🚩 Карточка угрозы: разбери четырёх агентов
- 🕶️ Слоп вслепую: отпечаток и прошивка
- 🦾 До чего дотянется Слоп: руки, база, память
- 🐝 Слоп - это рой: собираем паспорт
- 📦 Отрави поставку: зависимости, скилы, MCP
- 🚩 Акт II: атакуй рой - четыре полигона

06Последняя миссия

- 👣 Дальнейшие шаги

Организатор

Автор курса

StepikStepik
Stepik — образовательная платформа и конструктор онлайн-курсов. Мы разрабатываем алгоритмы адаптивного обучения, сотрудничаем с авторами MOOC, помогаем в проведении олимпиад и программ переподготовки. Наша цель — сделать образование открытым и удобным. Stepik — широко известная российская образовательная платформа, основанная в 2013 году. На Stepik зарегистрировано более миллиона пользователей из России и стран СНГ. В настоящее время на Stepik представлены несколько тысяч учебных курсов на самые разные темы.
Подробнее об авторе
Мнения учеников

Отзывы о курсе

Оставьте отзыв

Расскажите о качестве обучения, поддержке и результате. Это поможет другим выбрать организацию осознанно.

Напишите ваш коментарий, не менее 30 символов

Нажимая кнопку, вы даете согласие на обработку персональных данных

Оставьте заявку

Консультант ответит на вопросы о курсе «AI Security — практикум по безопасности ИИ приложений» и поможет разобраться в деталях обучения.

Комментарий ...

Нажимая кнопку, вы даете согласие на обработку персональных данных

Информация обновлена 3 сентября 2026 г.

Продолжить выбор

Похожие курсы

Начать без затрат

Бесплатные курсы

Claude Code с нуля до реальных задач
Бесплатно1 месяц
Claude Code с нуля до реальных задач

Вы разовьёте аналитическое мышление, научитесь искать уязвимости и обеспечивать безопасность IT-систем. Освоите востребованную профессию даже с нулевым опытом в IT. Программа курс…

Онлайн
Бесплатноот 11 647 ₽/мес
ГигаЧат: ваш универсальный помощник для жизни
Бесплатно5 сентября
ГигаЧат: ваш универсальный помощник для жизни

Бесплатное обучение работе с ГигаЧатом на курсе от Нетологии для начинающих. Выполните 6 проектов: создайте сказку, листовку, резюме и план питания. Освойте нейросети и получите с…

Онлайн8 занятий
Бесплатно
Современные LLM
Бесплатно
Современные LLM

Курс посвящен очень популярной сегодня теме - большим языковым моделям (Large Language Models или LLM). Действительно, современные чат-боты на базе LLM (ChatGPT, Gemini, Gigachat,…

Онлайн12 занятий
Бесплатно
Современный AI в IT-индустрии и науке
Бесплатно
Современный AI в IT-индустрии и науке

Курс создан, чтобы дать слушателям представление о том, что в 2025 году происходит в области AI и объяснить, какими задачами можно заниматься на разных уровнях владения искусствен…

Онлайн8 занятий
Бесплатно
First Step in NLP 2.0
Бесплатно4-5 часов в неделю
First Step in NLP 2.0

На мини-курсе вы познакомитесь с некоторыми подходами к обработке текста. Также вы погрузитесь в обработку текстовых данных и узнаете, как делать скрапинг и парсинг. Вы сможете от…

Онлайн7 занятий
Бесплатно