L'article soutient que le danger fondamental des systèmes d'IA actuels est leur tendance à combler les informations manquantes plutôt qu'à s'arrêter, conduisant à une exécution sans instruction explicite. Pour atténuer ce risque, il propose un cadre qui retire l'autorité de définition et de verdict du modèle lui-même.
- Le système déplace la décision de ce qui doit être vérifié en dehors du modèle.
- Le verdict sur le fait que la vérification a eu lieu est également déplacé en dehors du modèle.
- Les règles sont déclarées sous forme de listes de contrôle, tandis que le code effectue la vérification et enregistre le résultat.
- L'exécution ne progresse qu'en lisant le résultat enregistré déclaré par l'humain.
Cette structure garantit que les suppositions ne deviennent pas une exécution, maintenant à la fois l'autorité de prise de décision et la responsabilité avec les humains.