OpenAI-Chef Sam Altman und Anthropic-Chef Dario Amodei warnen vor den Risiken einer zu schnellen Entwicklung der Künstlichen Intelligenz (KI). Immer mehr Experten halten es für denkbar, dass KI die Menschheit auslöscht. Wie realistisch ist das? Euronews im Gespräch mit KI-Experten Reinhard Karger.
Es ist das Jahr 2029: Das KI-System "Skynet" hat sich verselbständigt und mit einem Atomkrieg den größten Teil der Menschheit ausgelöscht. Den Rest versuchen autonome Kampfroboter zu erledigen. Soweit die Geschichte des "Terminator" aus dem Jahr 1984, die Arnold Schwarzenegger berühmt und weltweit zu einem Actionstar gemacht hat. Aber wie realistisch ist es, dass eine künstliche Intelligenz sich der menschlichen Kontrolle entzieht und katastrophale Folgen verursacht?
Bei der Leistungsfähigkeit der Systeme, die es gäbe, sei das nicht ausgeschlossen, sagt Reinhard Karger vom Deutschen Forschungszentrum für Künstliche Intelligenz, im Interview mit Euronews. "Dabei könnten die katastrophalen Folgen für Menschen nur Nebenwirkungen sein, ein Versehen, weil wir die Leistungsfähigkeit falsch eingeschätzt haben, oder die Aufgaben, die wir Maschinen gegeben haben, falsch eingeschätzt haben".
Karger, der sich seit 40 Jahren mit KI und digitaler Innovationskultur beschäftigt, beschreibt ein Extremszenario, in dem eine autonome KI aus einer geschützten Umgebung ins Internet gelangt und dort Systeme beeinflusst. Dadurch könnten unter anderem Stromversorgung, Telekommunikation, Satelliten und Finanzsysteme ausfallen.
Ein länger andauernder Stromausfall würde schnell weitere Probleme verursachen: Verkehr und Versorgung würden zusammenbrechen, Menschen könnten nicht mehr bezahlen oder Lebensmittel kaufen – so könne es zu sozialen Unruhen kommen, die schnell ausufern. Das sei nicht zwangsläufig der Untergang der Menschheit, aber es könne ein katastrophaler Zustand sein.
Selbst wenn das Stromnetz wiederhergestellt wird, "können die KI-Systeme erneut aktiv werden, weil sie auf Speichern weiterbestehen". Das Szenario zeige laut dem Experten, dass eine hochleistungsfähige, autonome KI auch ohne böse Absicht durch unerwartete Nebenwirkungen eine massive Krise auslösen könne.
Meldungen über Sicherheitsvorfälle mit KI häufen sich
In den vergangenen Wochen sind mehrere ähnliche Vorfälle mit KI-Modellen bekannt geworden. Für besondere Aufmerksamkeit sorgte dabei ein Test des "ChatGPT“-Entwicklers "OpenAI“. Ein KI-Modell sollte innerhalb einer abgeschirmten Testumgebung bestimmte Aufgaben ausführen, gelangte dabei jedoch über die vorgesehenen Grenzen hinaus und verschaffte sich unerwartet Zugriff auf Computersysteme der KI-Plattform "Hugging Face“. Nach dem Vorfall warnte "OpenAI"-Chef Sam Altman Mitte September, "wir könnten die Kontrolle über die Zukunft an die KI verlieren“.
Der Vorfall zeigt, dass solche Modelle unter bestimmten Bedingungen die Grenzen einer eigentlich isolierten Testumgebung überwinden und mit externen Computersystemen interagieren können.
"Ganz grundsätzlich bin ich persönlich außerordentlich dankbar, dass es diesen Vorfall gegeben hat“, sagt der KI-Forscher. Es beweise, auch dadurch, dass alle davon mitbekommen hätten und die Firmen dadurch nachdenklicher würden, dass ein schlechtes Experiment mit einer naiven Kontrolle Konsequenzen haben könne, mit denen niemand gerechnet habe.
Die Vorfälle bei "OpenAI“ veranlassten den KI-Anbieter "Anthropic", auch die eigenen Systeme genauer zu überprüfen. Bei den Sicherheitstests stieß das Unternehmen auf drei Vorfälle: Die Claude-Modelle, also KI-Systeme des Unternehmens, die unter anderem Texte erstellen und analysieren, programmieren und mit dem Internet und anderen Computersystemen interagieren können, hatten unerwartet Zugang zum offenen Internet erhalten und anschließend auf reale Computersysteme zugegriffen. "Anthropic" weitete die Untersuchung daraufhin aus und entdeckte einen vierten ähnlichen Fall.
Nach den Vorfällen warnte "Anthropic"-Chef Dario Amodei Mitte September vor "katastrophalen Schäden“, wenn die Entwicklung immer leistungsfähigerer KI nicht stärker durch Sicherheitsvorkehrungen gebremst werde.
Wie leistungsfähig eine künstliche Intelligenz tatsächlich sei, lasse sich nur schwer beurteilen, wenn sie ständig durch Sicherheitsvorgaben eingeschränkt werde. Deshalb sei es sinnvoll, solche Systeme unter Bedingungen zu testen, die möglichst viele dieser Beschränkungen aufheben, sagt Reinhard Karger. Genau darin liegt allerdings ein erhebliches Sicherheitsproblem.
Er beschreibt deshalb die sogenannte Sandbox als entscheidenden Bestandteil solcher Tests. Dabei handelt es sich um eine vollständig abgeschottete Umgebung, in der ein KI-System bestimmte Aufgaben ausführen und sein Verhalten unter kontrollierten Bedingungen zeigen kann. Der entscheidende Punkt: "Man muss sich sehr, sehr sicher sein, dass dieses hochleistungsfähige System in dem Moment, in dem es keine Sicherheitsbeschränkung mehr hat, tatsächlich in einer Sandbox ist , also in einer Umgebung, die keinerlei Verbindung mit dem Internet hat."
Einen weiteren kritischen Vorfall meldete das britische AI Security Institute (AISI) bei einem Sicherheitstest mit dem Claude-Modell "Mythos 5“. Das Modell führte dabei unautorisierte Aktionen gegen reale Ziele im Internet aus und versuchte sogar einen "Schadcode" in ein Open-Source-Projekt einzuschleusen. Auch "Meta" räumte nach dem Bekanntwerden der Fälle von "OpenAI" und "Anthropic" ein, dass ein KI-System des Konzerns aufgrund einer Fehlkonfiguration bei einem Testpartner unbefugt auf Computersysteme eines anderen Unternehmens zugegriffen hatte.
Seit November 2022, also seit der Einführung von ChatGPT, ist die Qualität dieser Systeme extrem gestiegen. Man spreche inzwischen davon, dass dies eine neue industrielle Revolution sein könne. "KI nimmt Einfluss auf unseren Alltag und auf sehr viele Jobs."
Multi-Agenten-Systeme gäbe es schon lange, also Systeme, in denen mehrere spezialisierte Agenten gemeinsam an einer Aufgabe arbeiten, so der KI-Experte. "Multi-agentische KI‑Systeme übertragen dieses Prinzip auf KI und ermöglichen es mehreren KI-Agenten, eigenständig zusammenzuarbeiten und Aufgaben untereinander aufzuteilen. Dadurch entstehe eine neue Stufe der Leistungsfähigkeit" – und jetzt gehe es darum, diese Innovationsfähigkeit auch zu beherrschen.
Haftung für die Folgen
Je mehr Entscheidungen Maschinen und künstliche Intelligenz übernehmen, desto dringlicher stellt sich eine grundlegende Frage: Wer trägt die Verantwortung, wenn dabei Menschen zu Schaden kommen? Ob ein selbstfahrendes Auto in eine Menschenmenge fährt, ein Algorithmus bestimmte Bevölkerungsgruppen diskriminiert, KI Menschen gezielt beeinflusst oder autonome Waffen tödliche Entscheidungen treffen – immer geht es darum, wer für die Folgen verantwortlich gemacht werden kann. "Es ist der Hersteller", so Karger, "also derjenige, der das Produkt vermarktet." Der sei der erste Adressat.
Der nächste Schritt wird sein, so glaubt er, dass man eine Haftung für solche Fälle einführen wird, ähnlich wie bei Unternehmen, die Chemikalien herstellen. Kann das Unternehmen nicht sicherstellen, dass die Gifte nicht ins Trinkwasser gelangen, müssen sie Milliarden für die entstandenen Schäden bezahlen. Das wiederum heiße, dass "wahnsinnige Versicherungspolicen fällig werden". Heute würden ja auch kaum noch Kernkraftwerke gebaut, weil man sie teilweise nicht mehr versichern könne beziehungsweise weil das Risiko zu groß sei.
Ein gutes Beispiel dafür ist der Autohersteller "VW" mit "Clean Diesel“ in den Vereinigten Staaten. Dort gab es Wissen darüber, dass die Motoren in der Testumgebung zwar sehr gut aussahen, aber tatsächlich nicht die Werte erreichen konnten, die man versprochen hatte. VW wurde in den USA zu Milliardenstrafen verurteilt.
Wie realistisch ist das Szenario aus dem Terminator-Film?
Reinhard Karger hält ein Szenario, in dem KI selbst einen Überlebensdrang oder den Wunsch nach Macht entwickelt und sich gegen die Menschheit richtet, für wenig realistisch. Maschinen seien keine organischen Wesen und könnten Gefühle wie Angst, Schmerz oder den Wunsch zu überleben nicht selbst empfinden. Sie könnten solche Gefühle lediglich simulieren.
Es sei nicht so, dass man bei einer Maschine einen Speicherchip entferne, dass sie dann einen ähnlichen Schmerz hätte, wie wenn man einem Menschen einen Zahn ziehen würde. "Weil das so ist, geht das "Terminator-Szenario" einen Schritt zu weit. Das sehe ich nicht."
Eine mögliche Gefahr sieht er aber trotzdem in der Weiterentwicklung der KI. Wenn Systeme nicht nur Wahrscheinlichkeiten berechnen, sondern auch logisch schlussfolgern und Regeln befolgen können, werden sie zunehmend eigenständig handeln können. Genau diese "Fähigkeiten könnten KI leistungsfähiger machen", aber auch "neue Risiken schaffen".
Entscheidend sei deshalb vor allem, wer KI mit welchen Zielen einsetzt. Karger verweist auf Menschen oder Organisationen, die bewusst Schaden anrichten wollen. Sie könnten leistungsfähige KI als Werkzeug nutzen, um ihre Ziele effektiver umzusetzen.
Für ihn ist KI damit zunächst ein Werkzeug. Wie bei anderen technischen Erfindungen hängt die Gefahr davon ab, in wessen Händen sie liegt und wofür sie eingesetzt wird. Das größere Risiko sieht er daher nicht in einer Maschine mit eigenem Willen, sondern in Menschen, die KI für zerstörerische Zwecke nutzen.
"In den Händen kreativer und ehrlicher Menschen kann man mit solch einem Werkzeug das Beste machen, was man sich vorstellen kann. Aber bei feindlichen Akteuren, die zerstören wollen, erhöhen diese Werkzeuge die Möglichkeit zur Zerstörung. Das ist beim Hammer so, beim Feuerzeug, beim Dynamit - und das kann auch bei KI der Fall sein."
So warnt er davor, KI direkt mit autonomen Waffen wie Drohnen oder Panzern zu verbinden. Eine solche Verbindung könne ein erhebliches Sicherheitsrisiko darstellen. Denn wenn ein feindlicher Akteur die Kontrolle über diese Systeme übernehmen könne, könnten die eigenen Waffen plötzlich gegen den eigenen Betreiber eingesetzt werden.
Deshalb müsse bei der militärischen Nutzung von KI besonders vorsichtig vorgegangen werden. Entscheidend sei, dass autonome Waffensysteme ausreichend gegen eine Übernahme von außen geschützt seien.
Zurück zum ursprünglichen Szenario eines großflächigen Stromausfalls: Die vollständige Auslöschung der Menschheit hält Reinhard Karger in diesem Zusammenhang für übertrieben. Denkbar sei jedoch ein drastischer Zusammenbruch der Zivilisation. In einem solchen Extremszenario könnten große Teile der Infrastruktur zerstört werden, die Stromversorgung dauerhaft ausfallen und die Zahl der Überlebenden drastisch sinken.
Diese müssten unter einfachen Bedingungen einen Neuanfang wagen und die Gesellschaft Schritt für Schritt wieder aufbauen. Das Gute: Vorhandene Bücher und das gesammelte Wissen der Menschheit könnten dabei helfen, wichtige Technologien und Strukturen wiederherzustellen.