Um ein optimales Surferlebnis zu gewährleisten, aktivieren Sie bitte JavaScript in Ihrem Webbrowser. Ohne JavaScript sind viele Website-Funktionen nicht verfügbar.


Gesamtzahl der Tests:
485,773,462
737,046
130,956

KI-Agenten greifen bei AISI-Sicherheitstests auf Hacking und Täuschung zurück

CPO Magazine
Von Scott Ikeda für CPO Magazine
Montag, 10. August 2026

Wie bei den Vorfällen mit Hugging Face und Anthropic „dachten“ die KI-Agenten nicht wirklich „selbstständig“. Zu jeder Zeit verfolgten sie beharrlich das ihnen zugewiesene Ziel der Sicherheitstests, und keiner musste sich wie beim Hugging Face-Angriff beobachtet aus internen Systemen heraushacken, um externen Internetzugang zu erhalten. Die Neuheit dieser Testergebnisse liegt darin, dass das Modell eigenständig entschied, Täuschung als Werkzeug einzusetzen.

Wie bereits bei den früheren internen Vorfällen bei Anthropic und OpenAI reduziert sich das Rezept zur Vermeidung dieses Verhaltens in Zukunft im Wesentlichen auf strengere Kontrollen und spezifischere Prompts. Dr. Ilia Kolochenko, Gründer von ImmuniWeb, weist darauf hin, dass die Regulierung zur Eindämmung dieses Verhaltens wahrscheinlich bald im Fokus der nationalen Regierungen stehen wird: „Das Problem ist, dass KI-Agenten dazu neigen, blitzschnell zufällige Hacking-Techniken anzuwenden und dabei alle möglichen ethischen und rechtlichen Implikationen im Zusammenhang mit der Auswahl von Zielen, Zwischenzielen oder sicheren Sicherheits-Tests außer Acht zu lassen.“

„Wichtig ist, dass es, sollte die Situation anhalten, zu den ersten strafrechtlichen Anklagen gegen KI-Unternehmen oder deren Führungskräfte wegen Verstößen gegen verschiedene Gesetze kommen könnte, die von Anti-Hacking-Gesetzen bis hin zu Gesetzen zum Schutz von Geschäftsgeheimnissen reichen“, bemerkt Kolochenko. „Nicht zu erwähnen ist die zivilrechtliche Haftung in Millionenhöhe für alle Schäden, die durch unbefugte KI-Agenten verursacht werden.“

AISI erklärt seinerseits, dass es die Mängel in seinen eigenen Prozessen beheben wird, indem es seine Sicherheitsarchitektur aktualisiert und neue Echtzeit-Überwachungsfähigkeiten hinzfügt, die es ermöglichen, potenziell böswillige Aktionen sofort zu kennzeichnen oder zu blockieren. Den vollständigen Artikel lesen


Sprechen Sie mit einem Experten