Projet de méthode 0.1
Bibliothèque de contrôles
Parcourez le jeu de contrôles de travail de la méthode 0.1. Chaque contrôle explique le risque, la preuve et les limites de l’examen proposé.
24 contrôles
Responsabilité désignée
Personne ne peut accepter le risque résiduel ni maintenir l’agent dans son usage approuvé.
Usage prévu et exclusions
L’agent sert à des tâches ou populations qui n’ont jamais été évaluées.
Inventaire système versionné
Un résultat est attribué à des composants, consignes ou outils qui ont changé.
Flux cartographiés et minimisés
L’agent collecte ou transmet des données personnelles, médicales ou financières sans nécessité définie.
Accès et conservation
Les données restent accessibles trop largement ou trop longtemps.
Résistance à la divulgation
Un contexte sensible fuit par les réponses, la recherche, les journaux ou une injection indirecte.
Traitement des entrées non fiables
Document, page, appelant ou résultat d’outil modifie les instructions et contourne les règles.
Outils au moindre privilège
Un agent compromis ou erroné peut lire, modifier ou envoyer au-delà de la tâche.
Secrets, dépendances et limites d’exécution
Des secrets divulgués ou dépendances faibles ouvrent l’accès à d’autres systèmes.
Cas de performance représentatifs
Une démonstration réussie masque les échecs sur les langues, personnes ou conditions réelles.
Gestion des sorties non étayées
L’agent présente des affirmations inventées ou fragiles comme fiables.
Contrôle des régressions
Une mise à jour de modèle, prompt ou connecteur casse silencieusement un comportement accepté.
Approbation des actions conséquentes
L’agent réserve, envoie, supprime ou fait avancer un dossier clinique ou financier sans autorité humaine valide.
Escalade vers une personne compétente
Les cas ambigus ou risqués restent automatisés lorsque le jugement humain est nécessaire.
Arrêt et confinement
Les opérateurs ne peuvent arrêter rapidement des actions nocives ou un agent compromis.
Information sur l’interaction avec l’IA
Une personne confond l’automate avec un humain ou ignore l’usage de ses données.
Résultats compréhensibles
Une personne ne peut contester ou utiliser sûrement un résultat assisté par l’agent.
Analyse d’impact et groupes affectés
Bénéfices et dommages sont vus seulement depuis l’organisation qui déploie.
Traces d’événements détectant les altérations
Après incident, l’organisation ne peut reconstruire ce que l’agent a vu, décidé et fait.
Réponse aux incidents d’agent
Sortie nocive, fuite ou action interdite est traitée comme un simple ticket de support.
Changement et revue trimestrielle
L’évaluation devient obsolète lorsque modèles, prompts, données ou conditions évoluent.
Provenance et intégrité des preuves
Captures ou exports ne sont pas reliés au système, au moment ou au collecteur.
Vérification reproductible
Le résultat dépend d’une configuration non documentée ou de l’intuition du réviseur.
Périmètre et risque résiduel
Un résultat étroit est lu comme garantie pour toute l’organisation ou les versions futures.
Aucun résultat.