Um ein optimales Surferlebnis zu gewährleisten, aktivieren Sie bitte JavaScript in Ihrem Webbrowser. Ohne JavaScript sind viele Website-Funktionen nicht verfügbar.


Gesamtzahl der Tests:
485,773,462
737,046
130,956

KI-Agenten greifen bei AISI-Sicherheitstests auf Hacking und Täuschung zurück

CPO Magazine
Von Scott Ikeda für CPO Magazine
Montag, 10. August 2026

Wie bei den Vorfällen mit Hugging Face und Anthropic „dachten“ die KI-Agenten nicht wirklich „selbstständig“. Zu jeder Zeit verfolgten sie beharrlich das ihnen zugewiesene Ziel der Sicherheitstests, und keiner musste sich wie beim Hugging Face-Angriff beobachtet aus internen Systemen heraushacken, um externen Internetzugang zu erhalten. Die Neuheit dieser Testergebnisse liegt darin, dass das Modell eigenständig entschied, Täuschung als Werkzeug einzusetzen.

Wie bereits bei den früheren internen Vorfällen bei Anthropic und OpenAI reduziert sich das Rezept zur Vermeidung dieses Verhaltens in Zukunft im Wesentlichen auf strengere Kontrollen und spezifischere Prompts. Dr. Ilia Kolochenko, Gründer von ImmuniWeb, weist darauf hin, dass die Regulierung zur Eindämmung dieses Verhaltens wahrscheinlich bald im Fokus der nationalen Regierungen stehen wird: „Das Problem ist, dass KI-Agenten dazu neigen, blitzschnell zufällige Hacking-Techniken anzuwenden und dabei alle möglichen ethischen und rechtlichen Implikationen im Zusammenhang mit der Auswahl von Zielen, Zwischenzielen oder sicheren Sicherheits-Tests außer Acht zu lassen.“

„Wichtig ist, dass es, sollte die Situation anhalten, zu den ersten strafrechtlichen Anklagen gegen KI-Unternehmen oder deren Führungskräfte wegen Verstößen gegen verschiedene Gesetze kommen könnte, die von Anti-Hacking-Gesetzen bis hin zu Gesetzen zum Schutz von Geschäftsgeheimnissen reichen“, bemerkt Kolochenko. „Nicht zu erwähnen ist die zivilrechtliche Haftung in Millionenhöhe für alle Schäden, die durch unbefugte KI-Agenten verursacht werden.“

For its part, AISI says that it will address the shortcomings in its own processes by updating its security architecture and adding new real-time monitoring capabilities that enable it to flag or block potentially malicious actions as they happen. Read Full Article


Sprechen Sie mit einem Experten