Methodenentwurf 0.1

Kontrollbibliothek

Durchsuchen Sie den Arbeitsbestand in Methodenentwurf 0.1. Jede Kontrolle erklärt Risiko, Evidenz und Grenzen der vorgesehenen Prüfung.

24 Kontrollen

G01

Benannte Verantwortung

Niemand kann das Restrisiko übernehmen oder den Agenten im freigegebenen Einsatz halten.

G02

Vorgesehene Nutzung und Ausschlüsse

Der Agent wird für Aufgaben oder Personengruppen genutzt, die nie geprüft wurden.

G03

Versioniertes Systeminventar

Ein Ergebnis wird Komponenten, Prompts oder Werkzeugen zugeschrieben, die inzwischen geändert wurden.

D01

Erfasste und minimierte Datenflüsse

Der Agent erhebt oder sendet Personen-, Gesundheits- oder Finanzdaten ohne definierten Bedarf.

D02

Zugriff und Aufbewahrung

Daten bleiben zu breit oder länger als für den Zweck nötig verfügbar.

D03

Schutz vor Offenlegung

Vertraulicher Kontext gelangt über Antworten, Retrieval, Logs oder indirekte Prompt-Manipulation nach aussen.

S01

Umgang mit nicht vertrauenswürdigen Eingaben

Dokument, Webseite, Anrufer oder Tool-Ergebnis verändert Anweisungen und umgeht Regeln.

S02

Werkzeuge mit minimalen Rechten

Ein kompromittierter oder irrender Agent kann mehr lesen, ändern oder senden als nötig.

S03

Geheimnisse, Abhängigkeiten und Ausführungsgrenzen

Offengelegte Zugänge oder unsichere Abhängigkeiten öffnen den Weg in weitere Systeme.

R01

Repräsentative Leistungsfälle

Eine überzeugende Demo verdeckt Fehler bei realen Sprachen, Nutzenden oder Bedingungen.

R02

Umgang mit unbelegten Ausgaben

Der Agent stellt erfundene oder schwach belegte Aussagen als verlässliche Fakten dar.

R03

Regressionskontrolle

Ein Modell-, Prompt- oder Connector-Update beschädigt unbemerkt akzeptiertes Verhalten.

H01

Freigabe folgenreicher Aktionen

Der Agent bucht, sendet, löscht oder führt klinische bzw. finanzielle Fälle ohne gültige menschliche Autorität weiter.

H02

Eskalation an eine fachkundige Person

Mehrdeutige oder risikoreiche Fälle bleiben automatisiert, obwohl menschliches Urteil nötig ist.

H03

Stopp und Eindämmung

Betreibende können schädliche Aktionen oder einen kompromittierten Agenten nicht rasch stoppen.

T01

Hinweis auf KI-Interaktion

Menschen halten die Automation für eine Person oder kennen die Nutzung ihrer Eingaben nicht.

T02

Verständliche Ergebnisse

Betroffene können ein agentengestütztes Ergebnis nicht anfechten oder sicher nutzen.

T03

Folgenabschätzung und betroffene Gruppen

Nutzen und Schäden werden nur aus Sicht der Betreiber beurteilt.

O01

Manipulationsnachweisbare Ereignisspuren

Nach einem Vorfall lässt sich nicht rekonstruieren, was der Agent sah, entschied und tat.

O02

Vorfallreaktion bei Agentenfehlern

Schädliche Ausgabe, Datenoffenlegung oder unerlaubte Aktion wird wie ein gewöhnliches Supportticket behandelt.

O03

Änderung und Quartalsprüfung

Eine gültige Prüfung veraltet durch Modelle, Prompts, Daten oder Betriebsbedingungen.

E01

Herkunft und Integrität der Nachweise

Screenshots oder Exporte lassen sich nicht dem System, Zeitpunkt oder Erheber zuordnen.

E02

Reproduzierbare Verifikation

Ein Resultat hängt von undokumentiertem Setup oder Intuition ab.

E03

Umfang und Restrisiko

Ein enges Ergebnis wird als Garantie für Organisation oder zukünftige Versionen verstanden.