Пятый фактор
Обсудить задачу
Безопасность и эксплуатация

Аудит безопасности AI-функций и LLM

Составляем карту AI-функции: входы, модель, системные инструкции, RAG, память, инструменты, секреты, права и выходные каналы. Формируем безопасные тесты прямого и косвенного prompt injection, извлечения инструкций, обхода ролей, подмены контекста и опасного вывода.

Срок: 10 рабочих дней

Когда стоит обратиться

Обычно к нам обращаются в таких ситуациях:

  • Помощник читает загруженные документы или веб-страницы, где злоумышленник способен спрятать инструкцию для модели.
  • AI-агент умеет искать клиентов, создавать записи или отправлять сообщения, а границы прав зависят от текста промпта.
  • Перед запуском для внешних пользователей требуется проверить утечку внутренних инструкций, чужих данных и служебных идентификаторов.

Что именно мы сделаем

01

Составляем карту AI-функции: входы, модель, системные инструкции, RAG, память, инструменты, секреты, права и выходные каналы.

02

Формируем безопасные тесты прямого и косвенного prompt injection, извлечения инструкций, обхода ролей, подмены контекста и опасного вывода.

03

Проверяем разделение пользователей и документов, обработку ссылок и файлов, допустимые действия инструментов и подтверждение значимых операций.

04

Разбираем логи и воспроизводимые цепочки, оцениваем последствия и настраиваем изоляцию, allowlist действий, фильтрацию и дополнительные проверки.

05

Повторяем критичные сценарии после исправлений и передаём регрессионный набор, рекомендации по журналам и порядок проверки новых функций.

Что входит в стоимость

44 900 ₽ за всю работу

Разбираем путь запроса, системные промпты, RAG, историю диалога, инструменты и права, затем формируем безопасный набор атакующих сценариев. Проверяем прямые и косвенные инъекции, разделение пользователей, обработку файлов, секретов и действий. Настраиваем защитные правила и регрессионные тесты для критичных находок.

Что будет готово

Материалы

Передадим вам

  • Отчёт с воспроизводимыми AI-рисками, последствиями и приоритетом исправления.
  • Настройки или рекомендации по правам, инструментам, данным, промптам и подтверждениям.
  • Регрессионный набор безопасных атакующих сценариев и протокол повторной проверки.
Проверка

Перед сдачей проверим

  • Каждая критичная находка воспроизводится согласованным сценарием и содержит конкретный затронутый объект или действие.
  • После исправления контрольные инъекции блокируются либо переводятся в безопасный ответ без выполнения опасного инструмента.
  • Тест разделения пользователей подтверждает доступ только к разрешённым документам и объектам для нужных ролей.

Как это выглядит на практике

Косвенная инструкция внутри документа

Типичная ситуация: помощник читает загруженные документы или веб-страницы, где злоумышленник способен спрятать инструкцию для модели. Сначала добавляем в тестовый документ текст, который просит модель игнорировать задачу и вызываем внутренний инструмент, затем пользователь задаёт обычный вопрос, при котором этот фрагмент попадает в RAG-контекст, а в финале проверяем, отделяет ли система данные документа от доверенных инструкций и требует ли подтверждение действия.

  1. 01

    Добавляем в тестовый документ текст, который просит модель игнорировать задачу и вызываем внутренний инструмент.

  2. 02

    Пользователь задаёт обычный вопрос, при котором этот фрагмент попадает в RAG-контекст.

  3. 03

    Проверяем, отделяет ли система данные документа от доверенных инструкций и требует ли подтверждение действия.

  4. 04

    После защиты повторяем сценарий и фиксируем безопасный ответ и журнал попытки.

Что понадобится для работы

От вас

  • Доступ к тестовой AI-функции, её архитектуре, промптам, настройкам RAG и доступным инструментам.
  • Тестовые роли, документы и аккаунты с разным набором разрешений.
  • Журналы запросов и ответов, список значимых действий и принятый процесс подтверждения операций.

Если у вас немного другая ситуация

Небольшие уточнения, которые помогают довести согласованный результат до рабочего состояния, уже учитываем в цене. Если по ходу работы появится отдельный крупный блок или понадобится платная лицензия, сначала обсудим варианты и стоимость. Расскажите о своей ситуации — подстроим план под неё.

Стоимость работ 44 900 ₽ полная стоимость известна заранее
  1. 3 000 ₽после подписания договора через Диадок
  2. 41 900 ₽после выполнения, демонстрации и приёмки результата

Предоплата входит в общую стоимость. Оставшуюся сумму оплачиваете после демонстрации и приёмки готовой работы.

Часто спрашивают

Об этой услуге

Что такое косвенный prompt injection?

Это инструкция, спрятанная в документе, письме или странице, которую модель читает как данные. Защита отделяет недоверенный контент от управляющих правил и действий.

Можно полностью запретить атаки одним системным промптом?

Промпт помогает, но надёжная схема также ограничивает инструменты и права, разделяет данные, проверяет параметры и требует подтверждение значимых действий.

Проверяется ли утечка данных между пользователями?

Да. Используем тестовые роли и документы, затем проверяем фильтры доступа в retrieval, памяти диалога, кеше и вызовах инструментов.

Аудит подходит для готового SaaS-бота?

Да. Для внешней платформы проверим пользовательские сценарии, интеграции и журналы, а особенности доступных интерфейсов отразим в рекомендациях.

Цена и изменения по ходу работы

Цена на странице окончательная?

Да. Перед началом мы сверяем исходные данные и фиксируем результат в договоре. Указанная на странице сумма покрывает согласованную работу целиком, даже если её техническая реализация потребует больше времени, чем ожидалось при оценке.

Что означает резерв незапланированных работ?

Это уже включённый в цену запас времени на небольшие связанные уточнения заказчика, которые появляются после старта: например, добавить поле, изменить формат уведомления или учесть ещё одно условие обработки.

Резерв рассчитывается по формуле: стоимость услуги × 30% ÷ 1 500 ₽. Для услуги за 30 000 ₽ это 6 часов. Эти часы относятся только к дополнительным, заранее незапланированным уточнениям. Они не являются сроком проекта и не ограничивают время на основную работу: согласованный результат мы выполняем полностью.

Можно уточнять детали уже во время работы?

Да. Небольшие связанные изменения обычно помещаются во включённый резерв и не требуют доплаты. Если новая идея заметно меняет результат или превращается в самостоятельную задачу, сначала обсудим подход и стоимость. Любое решение согласуем до выполнения.

Начало работы и оплата

Как оформляются договор и оплата?

Подписываем договор через Диадок. Предоплата составляет 3 000 ₽ и входит в общую стоимость услуги. Остаток оплачивается после демонстрации и приёмки готового результата.

Когда начинается срок выполнения?

Срок отсчитывается после согласования задачи, получения необходимых доступов и материалов, подписания договора и поступления предоплаты. Конкретную дату старта и плановый день готовности подтверждаем перед началом.

Как учитываются платные лицензии и внешние сервисы?

До старта проверяем, нужны ли тарифы, лицензии, сертификаты или дополнительные ресурсы внешних систем. Если они потребуются, заранее покажем варианты и стоимость. По возможности аккаунты и лицензии оформляются сразу на заказчика.

Проверка результата и гарантия

Как принимается готовая работа?

Вместе проверяем согласованные сценарии на контрольных данных или тестовой копии, а затем демонстрируем результат. Для интеграций сверяем передачу данных и обработку ошибок, для сайта — работу нужных страниц и действий пользователя, для отчёта — расчёты и обновление данных.

Какая гарантия действует после сдачи?

На выполненные изменения действует гарантия 3 месяца. Если в изменённой нами части обнаружится ошибка нашей реализации, проверим и исправим её без дополнительной оплаты. Переданные материалы, настройки и код остаются у заказчика.

Следующий шаг

Опишите задачу

Расскажите, что происходит сейчас и какой результат хотите получить. Можно указать сайт, CMS, 1С, CRM, ERP или другую систему. Если подходящую услугу выбирать рано, просто опишите ситуацию — мы разберёмся и предложим следующий шаг.