Аудит безопасности AI-функций и LLM
Составляем карту AI-функции: входы, модель, системные инструкции, RAG, память, инструменты, секреты, права и выходные каналы. Формируем безопасные тесты прямого и косвенного prompt injection, извлечения инструкций, обхода ролей, подмены контекста и опасного вывода.
Когда стоит обратиться
Обычно к нам обращаются в таких ситуациях:
- Помощник читает загруженные документы или веб-страницы, где злоумышленник способен спрятать инструкцию для модели.
- AI-агент умеет искать клиентов, создавать записи или отправлять сообщения, а границы прав зависят от текста промпта.
- Перед запуском для внешних пользователей требуется проверить утечку внутренних инструкций, чужих данных и служебных идентификаторов.
Что именно мы сделаем
Составляем карту AI-функции: входы, модель, системные инструкции, RAG, память, инструменты, секреты, права и выходные каналы.
Формируем безопасные тесты прямого и косвенного prompt injection, извлечения инструкций, обхода ролей, подмены контекста и опасного вывода.
Проверяем разделение пользователей и документов, обработку ссылок и файлов, допустимые действия инструментов и подтверждение значимых операций.
Разбираем логи и воспроизводимые цепочки, оцениваем последствия и настраиваем изоляцию, allowlist действий, фильтрацию и дополнительные проверки.
Повторяем критичные сценарии после исправлений и передаём регрессионный набор, рекомендации по журналам и порядок проверки новых функций.
Что входит в стоимость
44 900 ₽ за всю работу
Разбираем путь запроса, системные промпты, RAG, историю диалога, инструменты и права, затем формируем безопасный набор атакующих сценариев. Проверяем прямые и косвенные инъекции, разделение пользователей, обработку файлов, секретов и действий. Настраиваем защитные правила и регрессионные тесты для критичных находок.
Что будет готово
Передадим вам
- Отчёт с воспроизводимыми AI-рисками, последствиями и приоритетом исправления.
- Настройки или рекомендации по правам, инструментам, данным, промптам и подтверждениям.
- Регрессионный набор безопасных атакующих сценариев и протокол повторной проверки.
Перед сдачей проверим
- Каждая критичная находка воспроизводится согласованным сценарием и содержит конкретный затронутый объект или действие.
- После исправления контрольные инъекции блокируются либо переводятся в безопасный ответ без выполнения опасного инструмента.
- Тест разделения пользователей подтверждает доступ только к разрешённым документам и объектам для нужных ролей.
Как это выглядит на практике
Косвенная инструкция внутри документа
Типичная ситуация: помощник читает загруженные документы или веб-страницы, где злоумышленник способен спрятать инструкцию для модели. Сначала добавляем в тестовый документ текст, который просит модель игнорировать задачу и вызываем внутренний инструмент, затем пользователь задаёт обычный вопрос, при котором этот фрагмент попадает в RAG-контекст, а в финале проверяем, отделяет ли система данные документа от доверенных инструкций и требует ли подтверждение действия.
- 01
Добавляем в тестовый документ текст, который просит модель игнорировать задачу и вызываем внутренний инструмент.
- 02
Пользователь задаёт обычный вопрос, при котором этот фрагмент попадает в RAG-контекст.
- 03
Проверяем, отделяет ли система данные документа от доверенных инструкций и требует ли подтверждение действия.
- 04
После защиты повторяем сценарий и фиксируем безопасный ответ и журнал попытки.
Что понадобится для работы
От вас
- Доступ к тестовой AI-функции, её архитектуре, промптам, настройкам RAG и доступным инструментам.
- Тестовые роли, документы и аккаунты с разным набором разрешений.
- Журналы запросов и ответов, список значимых действий и принятый процесс подтверждения операций.
Если у вас немного другая ситуация
Небольшие уточнения, которые помогают довести согласованный результат до рабочего состояния, уже учитываем в цене. Если по ходу работы появится отдельный крупный блок или понадобится платная лицензия, сначала обсудим варианты и стоимость. Расскажите о своей ситуации — подстроим план под неё.
- 3 000 ₽после подписания договора через Диадок
- 41 900 ₽после выполнения, демонстрации и приёмки результата
Предоплата входит в общую стоимость. Оставшуюся сумму оплачиваете после демонстрации и приёмки готовой работы.
Часто спрашивают
Об этой услуге
Что такое косвенный prompt injection?
Это инструкция, спрятанная в документе, письме или странице, которую модель читает как данные. Защита отделяет недоверенный контент от управляющих правил и действий.
Можно полностью запретить атаки одним системным промптом?
Промпт помогает, но надёжная схема также ограничивает инструменты и права, разделяет данные, проверяет параметры и требует подтверждение значимых действий.
Проверяется ли утечка данных между пользователями?
Да. Используем тестовые роли и документы, затем проверяем фильтры доступа в retrieval, памяти диалога, кеше и вызовах инструментов.
Аудит подходит для готового SaaS-бота?
Да. Для внешней платформы проверим пользовательские сценарии, интеграции и журналы, а особенности доступных интерфейсов отразим в рекомендациях.
Цена и изменения по ходу работы
Цена на странице окончательная?
Да. Перед началом мы сверяем исходные данные и фиксируем результат в договоре. Указанная на странице сумма покрывает согласованную работу целиком, даже если её техническая реализация потребует больше времени, чем ожидалось при оценке.
Что означает резерв незапланированных работ?
Это уже включённый в цену запас времени на небольшие связанные уточнения заказчика, которые появляются после старта: например, добавить поле, изменить формат уведомления или учесть ещё одно условие обработки.
Резерв рассчитывается по формуле: стоимость услуги × 30% ÷ 1 500 ₽. Для услуги за 30 000 ₽ это 6 часов. Эти часы относятся только к дополнительным, заранее незапланированным уточнениям. Они не являются сроком проекта и не ограничивают время на основную работу: согласованный результат мы выполняем полностью.
Можно уточнять детали уже во время работы?
Да. Небольшие связанные изменения обычно помещаются во включённый резерв и не требуют доплаты. Если новая идея заметно меняет результат или превращается в самостоятельную задачу, сначала обсудим подход и стоимость. Любое решение согласуем до выполнения.
Начало работы и оплата
Как оформляются договор и оплата?
Подписываем договор через Диадок. Предоплата составляет 3 000 ₽ и входит в общую стоимость услуги. Остаток оплачивается после демонстрации и приёмки готового результата.
Когда начинается срок выполнения?
Срок отсчитывается после согласования задачи, получения необходимых доступов и материалов, подписания договора и поступления предоплаты. Конкретную дату старта и плановый день готовности подтверждаем перед началом.
Как учитываются платные лицензии и внешние сервисы?
До старта проверяем, нужны ли тарифы, лицензии, сертификаты или дополнительные ресурсы внешних систем. Если они потребуются, заранее покажем варианты и стоимость. По возможности аккаунты и лицензии оформляются сразу на заказчика.
Проверка результата и гарантия
Как принимается готовая работа?
Вместе проверяем согласованные сценарии на контрольных данных или тестовой копии, а затем демонстрируем результат. Для интеграций сверяем передачу данных и обработку ошибок, для сайта — работу нужных страниц и действий пользователя, для отчёта — расчёты и обновление данных.
Какая гарантия действует после сдачи?
На выполненные изменения действует гарантия 3 месяца. Если в изменённой нами части обнаружится ошибка нашей реализации, проверим и исправим её без дополнительной оплаты. Переданные материалы, настройки и код остаются у заказчика.