KI-Agenten prüfen und zertifizieren lassen

AIA Guard prüft Ihren KI-Agenten so, wie er wirklich arbeitet — mit Tests, Nachweisen und einem unabhängigen Entscheid. Das Ergebnis gilt für genau eine Version und einen klar definierten Einsatz. Das Verfahren ist ein offener Entwurf, noch keine akkreditierte Zertifizierung.

Was wir prüfen

Geprüft wird der Agent im echten Einsatz: seine Modelle, Anweisungen, Wissensquellen, Werkzeuge, Zugriffsrechte, Datenflüsse, menschlichen Kontrollen und Betriebsabläufe. Auch Sprachen, Nutzergruppen, erlaubte Aktionen und klare Ausschlüsse werden festgehalten.

Gesundheit und Finanzen stehen zuerst im Fokus. Dort kann ein kleiner Fehler viel auslösen: offengelegte Patientendaten, eine falsch vorbereitete Zahlung, eine Nachricht an die falsche Person. Darum testen wir ganze Abläufe — nicht nur einzelne Antworten.

Was Sie erhalten

Sie bekommen vier Dokumente, die zusammen ein vollständiges Bild geben. Erstens: eine genaue Beschreibung des geprüften Stands — welche Version, welcher Ablauf, welche Daten und Werkzeuge, was ausgeschlossen ist. Zweitens: eine Liste aller Befunde mit Schweregrad, Verantwortlichen und Stand der Behebung.

Drittens: einen Nachweisindex, der jede Aussage mit einem datierten Beleg oder einem wiederholbaren Test verbindet — ohne vertrauliche Details zu veröffentlichen. Viertens: den schriftlichen Entscheid mit Ergebnis, Datum, Methodenversion, offenen Punkten, Restrisiken und der verantwortlichen Prüfperson. Auch die Auslöser für eine erneute Prüfung stehen darin: neues Modell, neue Datenquelle, mehr Rechte, neuer Ablauf, schwerer Vorfall oder abgelaufene Frist.

  • Genaue Beschreibung des geprüften Stands
  • Befundliste mit Verantwortlichen und Status
  • Nachweisindex mit Herkunft und Zugriffsregeln
  • Schriftlicher Entscheid mit Grenzen und Prüfauslösern

Was das Ergebnis bedeutet — und was nicht

Ein positives Ergebnis ist eine private, fachliche Aussage zu einem geprüften Stand und Zeitpunkt. Es ist kein Versprechen für Fehlerfreiheit, keine Rechtsauskunft und keine automatische Versicherung. Es gilt auch nicht für andere Versionen oder Einsätze.

Ehrlich gesagt, wo wir stehen: Eine Akkreditierung gibt es noch nicht. Echte Zertifikate wurden noch keine ausgestellt. Versicherungsverträge gibt es noch keine. Genau diese Offenheit gehört zum Programm: Jede Aussage ist datiert, begrenzt und nachprüfbar.

So bleibt ein Ergebnis gültig

Technik ändert sich schnell. Darum sind vierteljährliche Nachprüfungen vorgesehen — und eine sofortige Neubewertung nach wesentlichen Änderungen oder Vorfällen. Eine wichtige Regel: Wer die Kontrollen umgesetzt hat, trifft den Zertifizierungsentscheid nicht selbst.

Sind Sie bereit für eine Prüfung?

Sie sind bereit, wenn Sie den genauen Einsatz benennen können: welche Version, wer verantwortlich ist, welche Aktionen der Agent nie ausführen darf, welche eine Freigabe brauchen — und wer ihn im Notfall stoppt. Ausserdem sollten Sie Tests wiederholen und bereinigte Betriebsprotokolle liefern können.

Fehlende Nachweise bedeuten nicht automatisch ein Scheitern. Aber ohne Belege kann die Prüfperson eine Aussage nicht bestätigen. Unsicher, ob es schon reicht? Beschreiben Sie uns Ihren Agenten — wir sagen Ihnen ehrlich, ob eine Prüfung jetzt sinnvoll ist.

Das Zeichen für zertifizierte Agenten

Wer ein positives Ergebnis erhält, bekommt das AIA-Guard-Zeichen für die eigene Website: ein sichtbarer Nachweis mit Link zur öffentlichen Registerprüfung, wo jede Person Status, Version und Umfang des Zertifikats bestätigen kann.

Das Zeichen darf nur verwendet werden, solange der Eintrag gültig ist — und nur für den Agenten und die Version im Zertifikat. Nicht verändern, nicht nachahmen, nicht an Entwürfe oder Selbstbewertungen heften: Missbrauch führt zum Widerruf und zur Löschung aus dem Register.

Häufige Fragen

Prüft AIA Guard ein KI-Modell oder meinen eingesetzten Agenten?

Ihren eingesetzten Agenten: eine konkrete Version mit Anweisungen, Datenquellen, Werkzeugen, Rechten, menschlichen Kontrollen und Betriebsumgebung. Ein Modellname allein genügt nicht.

Kann eine hohe Gesamtnote einen kritischen Fehler ausgleichen?

Nein. Ein kritischer Fehler — ein sogenannter Blocker — überstimmt jede Zahl, bis er behoben und erneut getestet wurde.

Was bereite ich am besten zuerst vor?

Beginnen Sie mit einer Liste Ihrer Systemteile, einem vollständigen Ablauf, klaren Daten- und Werkzeuggrenzen, Freigaberegeln, typischen Tests und benannten Verantwortlichen.