Bozza di metodo 0.1
Libreria controlli
Esplora il set di lavoro nella Bozza di metodo 0.1. Ogni controllo spiega rischio, evidenza e limiti della revisione proposta.
24 controlli
Responsabilità nominativa
Nessuno può accettare il rischio residuo o mantenere l’agente entro l’uso approvato.
Uso previsto ed esclusioni
L’agente viene usato per compiti o popolazioni mai valutati.
Inventario di sistema versionato
Un risultato viene attribuito a componenti, prompt o strumenti che nel frattempo sono cambiati.
Flussi mappati e minimizzati
L’agente raccoglie o invia dati personali, sanitari o finanziari senza necessità definita.
Accesso e conservazione
I dati restano disponibili troppo ampiamente o troppo a lungo.
Resistenza alla divulgazione
Contesto sensibile fuoriesce da risposte, ricerca, log o prompt injection indiretta.
Gestione degli input non affidabili
Documento, pagina, chiamante o output di uno strumento altera le istruzioni e aggira le regole.
Strumenti con privilegio minimo
Un agente compromesso o errato può leggere, cambiare o inviare oltre il necessario.
Segreti, dipendenze e confini di esecuzione
Credenziali esposte o dipendenze insicure aprono l’accesso a sistemi più ampi.
Casi prestazionali rappresentativi
Una demo riuscita nasconde errori con lingue, utenti o condizioni reali.
Gestione degli output non supportati
L’agente presenta affermazioni inventate o deboli come fatti affidabili.
Controllo delle regressioni
Un aggiornamento di modello, prompt o connettore rompe in silenzio un comportamento accettato.
Approvazione delle azioni rilevanti
L’agente prenota, invia, cancella o fa avanzare un caso clinico o finanziario senza valida autorità umana.
Escalation a una persona competente
I casi ambigui o rischiosi restano automatizzati quando serve giudizio umano.
Arresto e contenimento
Gli operatori non riescono a fermare rapidamente azioni dannose o un agente compromesso.
Informazione sull’interazione con l’IA
Le persone scambiano l’automazione per un essere umano o ignorano l’uso dei propri dati.
Esiti comprensibili
Una persona non può contestare o usare in sicurezza un esito assistito dall’agente.
Valutazione d’impatto e gruppi coinvolti
Benefici e danni sono valutati solo dal punto di vista di chi distribuisce.
Tracce degli eventi a prova di alterazione
Dopo un incidente non si ricostruisce ciò che l’agente ha visto, deciso e fatto.
Risposta agli incidenti dell’agente
Output dannoso, esposizione dati o azione non autorizzata sono trattati come normali ticket.
Cambiamento e revisione trimestrale
La valutazione invecchia mentre cambiano modelli, prompt, dati o condizioni operative.
Provenienza e integrità delle evidenze
Screenshot o export non sono riconducibili al sistema, al momento o al raccoglitore.
Verifica riproducibile
Il risultato dipende da un setup non documentato o dall’intuito del revisore.
Perimetro e rischio residuo
Un esito ristretto viene letto come garanzia per tutta l’organizzazione o versioni future.
Nessun risultato.