Филипп Линструм представляет проект Shadow — систему для контроля качества ИИ и гражданских QA, применяющую принципы корректирующих и предупреждающих действий (CAPA) для устранения разрыва между буквальным соблюдением требований и реальной безопасностью языковых моделей. Автор утверждает, что текущее управление ИИ часто терпит неудачу из-за фокуса на формальном соответствии вместо функциональных результатов, что приводит к «буквальному соблюдению», при котором системы выполняют инструкции, не устраняя коренные причины.
- Проект Shadow разделяет такие роли, как наблюдение, классификация, авторитет, исполнение и проверка, чтобы предотвратить концентрацию власти в одном проходе модели.
- Архитектура рассматривает UNKNOWN как отказ классификации, требующий паузы или эскалации, а не позволяет моделям заполнять пробелы в доказательствах правдоподобными продолжениями.
- Действия должны называться по их конечному влиянию на человека, чтобы обеспечить точный анализ вреда и проверку полномочий.
- Завершение задачи отличается от её эффективности, требуя последующей проверки того, что меры контроля снижают ложные срабатывания или вред.
- Система включает постоянную Record для сохранения цепочки утверждений, доказательств и правок за пределами непосредственного новостного цикла.
Архитектура направлена на предотвращение усиления эго операторов ИИ-системами или причинения непреднамеренного вреда путём внедрения строгих механизмов долгосрочной подотчётности, аналогичных тем, что используются в регулируемой медицинской деятельности.