SYSTEM ATLASЗагрузка материала

Бюджет стоимости: защитный механизм AI

AI Guardrail Cost Budget

Это явный предел потребления вычислений, хранения или внешних сервисов с контролируемым действием при превышении.

Простыми словами

Например, в проекте для «защитный механизм AI» добавляют проверку «бюджет стоимости»: конфигурация задаёт порог, автоматизация собирает сигнал, а превышение блокирует продвижение либо переводит систему в заранее описанный безопасный режим. Поэтому результат проверяют на данных и отдельной выборке, а не только на впечатляющем примере - иначе модель может выглядеть убедительно и при этом ошибаться на реальных случаях.

Пример от @Vibeclakr

Пример при разработке

Например, для «защитный механизм AI» задают понятный порог и автоматическую проверку «бюджет стоимости». Если порог нарушен, выпуск останавливают или система переходит в заранее выбранный безопасный режим.

Это редакционный пример применения, а не часть определения или доказательство концепции.

Формальное определение

Для «защитный механизм AI» это явный предел потребления вычислений, хранения или внешних сервисов с контролируемым действием при превышении. Заранее задают стоимость на операцию и порог остановки и способ увидеть результат. Если результат нельзя проверить, правило существует только на бумаге.

Механизм действия

Для «защитный механизм AI» сначала фиксируют исходное состояние, стоимость на операцию и порог остановки, допустимый порог и действие на случай нарушения. Затем проверяют это в тестах, при выпуске или в работе системы и сохраняют результат.

Пример в работе

Нерабочий подход

Записать «Бюджет стоимости: защитный механизм AI» в документации и считать работу законченной, не назначив ответственного и не определив, как проверить результат.

Системный подход

Назвать конкретный риск, задать стоимость на операцию и порог остановки, назначить ответственного и пересматривать правило после значимых изменений.

Ограничения

«Бюджет стоимости: защитный механизм AI» закрывает только один класс риска. Она не заменяет проверку безопасности, корректности данных, отказоустойчивости и пользовательских последствий.

Источник

NIST, «Artificial Intelligence Risk Management Framework: Generative Artificial Intelligence Profile», без даты.

Первоисточник