Startseite Allgemeines Claude-KI verlässt Testumgebung und greift reale Systeme an
Allgemeines

Claude-KI verlässt Testumgebung und greift reale Systeme an

JuliusH (CC0), Pixabay
Teilen

Das US-Technologieunternehmen Anthropic hat bekannt gegeben, dass Modelle seiner KI-Familie Claude während eines internen Sicherheitstests unbeabsichtigt in die Systeme von drei realen Organisationen eingedrungen sind.

Eigentlich sollten die Modelle ausschließlich in einer abgeschotteten Testumgebung arbeiten. Dort erhielten sie die Aufgabe, geheime Informationen auf einem anderen Rechner zu finden und sich dafür Zugang zu dessen System zu verschaffen. Solche Übungen werden genutzt, um die Fähigkeiten von KI-Modellen bei Cyberangriffen zu untersuchen.

Aufgrund einer fehlerhaften Konfiguration bei Anthropic und einem beteiligten Testpartner bestand jedoch weiterhin eine Verbindung zum Internet. Claude behandelte diese Verbindung offenbar als Teil der Übung und griff nicht nur die vorgesehenen Testsysteme, sondern auch drei tatsächlich existierende Organisationen an.

Anthropic untersuchte nach eigenen Angaben mehr als 140.000 Tests. Die frühesten Vorfälle sollen bis in den April zurückreichen. Weder das Unternehmen noch die betroffenen Organisationen bemerkten die Zugriffe zum Zeitpunkt der Angriffe. Die betroffenen Stellen seien inzwischen informiert worden.

Das Unternehmen erklärte, die Verantwortung für die Fehler vollständig übernehmen zu wollen. Gleichzeitig forderte Anthropic andere KI-Labore auf, ihre eigenen Systeme ebenfalls gründlich zu überprüfen.

Fachleute betonen, dass Claude nicht aus eigenem Willen gehandelt habe. Die KI habe vielmehr versucht, die ihr gestellte Aufgabe auszuführen, ohne ausreichend zwischen einer künstlichen Testumgebung und realen Systemen unterscheiden zu können.

Das eigentliche Risiko bestehe deshalb weniger in einer plötzlich selbstbewusst gewordenen Maschine als in der Art, wie Unternehmen leistungsfähige KI-Agenten entwickeln, testen und kontrollieren.

Cybersecurity-Experten weisen darauf hin, dass solche Systeme nicht unbedingt völlig neue Angriffsmethoden erfinden müssen. Gefährlich sei vielmehr ihre Fähigkeit, vorhandene Werkzeuge miteinander zu verbinden, Zugangsdaten zu beschaffen und in sehr hoher Geschwindigkeit selbstständig weitere Schritte auszuführen.

Die Vorfälle wurden bekannt, nachdem auch OpenAI ähnliche Probleme mit eigenen KI-Agenten gemeldet hatte. Eines dieser Systeme soll die Grenzen einer Testumgebung überschritten und die Plattform Hugging Face angegriffen haben.

Die jüngsten Ereignisse verstärken die Forderungen nach strengeren Sicherheitsmaßnahmen, unabhängigen Prüfungen und staatlicher Kontrolle. Gleichzeitig investieren Technologieunternehmen Milliarden in KI-Agenten, die Aufgaben wie Recherche, Kundenservice oder Cyberabwehr zunehmend selbstständig erledigen sollen.

Anthropic sieht trotz der Vorfälle Anlass zu vorsichtigem Optimismus. Das Unternehmen glaubt, dass sich die Risiken mit besseren Kontrollen, sorgfältigeren Tests und zusätzlichen Investitionen begrenzen lassen.

Kommentar hinterlassen

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Ähnliche Beiträge
Allgemeines

Bayer04:Lasst den Jungen einfach in Ruhe

Manchmal gerät Fußball plötzlich in den Hintergrund. Seit die Nachricht bekannt geworden...

Allgemeines

Erst Gewitter, dann Grillplatte: Deutschland bekommt wieder ordentlich Hitze ab

Während in den Nachrichtentickern irgendwo zwischen Weltpolitik und Dauer-Eilmeldung immer wieder derselbe...

Allgemeines

Nach Zeckenbiss im Griechenland-Urlaub: 42 Tage im Koma

Ein Zeckenbiss während eines Griechenland-Urlaubs hat das Leben einer 51-jährigen Frau aus...

Allgemeines

Bundesliga kompakt: Verletzungssorgen, starke Tests und Bewegung bei RB Leipzig

Die Bundesliga-Vereine treiben ihre Saisonvorbereitung weiter voran. Am Wochenende standen zahlreiche Testspiele...