Teams verwenden unterschiedliche Modelle und Werkzeuge.
Ohne zentrale Kontrolle wird unklar, was freigegeben wurde und welche Version tatsächlich verwendet wird.
AI Security & Software Trust
Das Problem
Wenn KI-Agenten auf E-Mails, Daten, Werkzeuge oder Geschäftssysteme zugreifen, reicht eine gute Modellantwort nicht mehr. Unternehmen müssen kontrollieren, welche Komponenten vertrauenswürdig sind, welche Daten wohin dürfen und welche Aktionen tatsächlich erlaubt sind.
Ohne zentrale Kontrolle wird unklar, was freigegeben wurde und welche Version tatsächlich verwendet wird.
Wenn er E-Mails verschicken, Daten verändern oder andere Systeme ansprechen darf, kann aus einem falschen Vorschlag ein echter Geschäftsvorgang werden.
Nicht jede Information darf an jedes Modell oder jeden Anbieter gesendet werden.
Ein Tool oder dessen Beschreibung darf nicht dadurch vertrauenswürdig werden, dass ein Modell es überzeugend findet.
Wer durfte was tun? Welche Version war freigegeben? Welche Regel hat entschieden?
Die Lösung
Modelle, Agenten, Werkzeuge und Software erhalten bekannte Identitäten. Bevor eine kontrollierte KI-Anfrage ausgeführt oder eine vorgeschlagene Aktion als zulässig eingestuft wird, prüft Shield die dafür festgelegten Regeln.
Daten können klassifiziert, bekannte Geheimnisse erkannt und riskante Inhalte als Sicherheitssignal berücksichtigt werden. Vorgeschlagene Aktionen werden strukturiert und gegen die vorgesehenen Berechtigungen geprüft.
Das Modell darf Vorschläge machen. Die Sicherheitsentscheidung trifft nicht das Modell.
Was Shield übernimmt
Software über ihren tatsächlichen Inhalt und ihre hinterlegte Herkunft identifizieren – nicht nur über Dateinamen oder Tags.
Freigegebene Komponenten mit eindeutigen Identitäten und Versionen verwalten.
Sicherheitsregeln kontrolliert ändern und nachvollziehen, welcher Stand für eine Entscheidung galt.
Prüfen, welches Modell verwendet werden darf und ob eine Anfrage innerhalb der vorgesehenen Grenzen liegt.
Informationen nach Schutzbedarf einordnen, bevor sie weitergegeben werden.
Typische Zugangsdaten und Secrets deterministisch erkennen – ohne Vollständigkeitsversprechen.
Webinhalte, E-Mails, Tool-Ergebnisse oder Modellantworten als nicht vertrauenswürdige Eingaben behandeln und Risikosignale berücksichtigen.
Tool-Aufrufe in strukturierte Anfragen überführen und gegen konkrete Regeln und Parameter prüfen.
Wichtige Freigaben und Verweigerungen als nachvollziehbaren Nachweis festhalten.
Messung
Für Shield zählt zuerst der Negativbeweis: Tenant-Isolation, Policy-Determinismus, Replay-Schutz, Approval-Bindung. Leistungszahlen erst danach – und nur mit reproduzierbarer Evidenz.
Produktgrenzen
Shield entscheidet im aktuellen Produktstand, ob eine vorgeschlagene Aktion zulässig ist. Die eigentliche Ausführung dieser Aktion ist noch nicht Bestandteil dieses Produktstands.
Nächster Schritt
Beschreiben Sie den konkreten KI- oder Agenten-Workflow und welche Systeme betroffen sind. Dann lässt sich einordnen, wo Shield eine kontrollierte Grenze schaffen kann.